Anthropic发布Claude Haiku 5.5:价格大幅下调 但新分词器会消耗更多Token

📅 2026-10-08

摘要:

Anthropic正式发布Claude Haiku 5.5,这是Claude 5.5系列的第三款模型,也是继Claude Haiku 4.5近一年之后推出的新一代Haiku模型。Anthropic将其定位为面向高并发、低延迟和成本敏感型任务的轻量级模型,并通过大幅降低API价格,让Haiku 5.5直接进入当前低成本AI模型的竞争行列。

Artificial Analysis Intelligence Index (7 Oct '26).png

按照Anthropic公布的价格,Claude Haiku 5.5对于100000 Token以内的请求,输入价格为每百万Token 0.10美元,输出价格为每百万Token 0.50美元。相比上一代Haiku 4.5分别为1美元和5美元的价格,账面价格直接降低了90%。

如果请求超过100,000 Token,Haiku 5.5的价格则会明显提高,输入和输出价格分别上升至每百万Token 0.50美元和2.50美元。也就是说,一旦超过10万Token这个门槛,输入和输出价格都会变成基础价格的5倍。

Anthropic表示,按照实际工作负载计算,Haiku 5.5平均运行成本大约比Haiku 4.5低75%。之所以平均降幅没有达到宣传价格上的90%,其中一个重要原因是Haiku 5.5采用了新的分词器。

新的分词器与Claude Sonnet 5.5和Opus 5.5使用的分词方式相近。同样一段文字,在Haiku 5.5中可能会被计算成更多Token。Anthropic自己的说明显示,新的分词方式会使完成相同任务时产生的Token数量略有增加;一些实际测试则发现,同一长文本在Haiku 5.5中可能比Haiku 4.5多消耗大约25%至30%的Token。

这意味着Haiku 5.5存在一个容易被忽略的“隐性成本”。虽然每百万Token的价格大幅下降,但用户实际支付的费用还取决于模型为了完成任务究竟消耗多少Token。因此,单纯比较每百万Token的价格,并不能完全反映两代模型的实际运行成本。

Haiku 5.5仍然拥有非常大的上下文窗口,最高支持100万Token,同时最大输出长度达到128K Token。它还支持自适应思考能力,可以根据任务复杂程度动态决定需要投入多少推理资源。

Anthropic特别强调,Haiku 5.5的重点并不是与Opus 5.5或Sonnet 5.5争夺所有复杂任务,而是承担大量高频、重复和对响应速度敏感的工作。例如文本摘要、数据分类、信息提取、数据库查询、请求路由以及上下文压缩等,都属于Haiku 5.5比较适合的应用场景。

在AI Agent领域,Haiku 5.5也被设计为大型模型的辅助模型。Anthropic建议开发者可以让Sonnet 5.5或Opus 5.5负责复杂的主要任务,再让Haiku 5.5作为子代理处理大量简单的重复操作,从而降低整个Agent系统的运行成本。

1780331851_scale_1200.webp

代码开发同样是Haiku 5.5的重要应用方向之一。Anthropic表示,该模型可以作为大型Claude模型的编码子代理,用于处理代码搜索、简单修改以及其他可以拆分出来的重复性工作。不过在复杂的多步骤Agent编程任务中,Sonnet 5.5和Opus 5.5仍然具有更明显的优势。

速度则是Haiku 5.5的另一大卖点。Anthropic称,这是该公司目前响应速度最快的模型,因此特别适合实时客户服务、浏览器操作以及需要快速反馈的应用。

除了降低Haiku 5.5本身的价格,Anthropic还同步调整了Claude Sonnet 5.5的缓存读取价格。缓存读取费用从每百万Token 0.20美元降低至0.10美元,降幅达到50%。Anthropic认为,由于Agent任务通常会大量重复读取缓存内容,这一变化可以让Sonnet 5.5在大多数Agent工作负载中的实际成本降低约20%。

不过,Haiku 5.5最引人关注的仍然是它与低价模型之间的竞争。按照100000 Token以内的标准价格计算,Haiku 5.5已经与OpenAI最新的低成本模型处于相同价格区间。这意味着开发者现在可以在非常低的Token价格下获得一个拥有百万Token上下文窗口、支持自适应推理和较强代码能力的模型。

另一方面,10万Token的价格分界线也可能成为开发者需要特别注意的问题。对于普通的短文本请求,这个门槛通常不会造成影响;但对于长文档处理、复杂Agent、多轮代码任务以及大量上下文同时输入的场景,模型可能很容易接近甚至超过10万Token。一旦超过这一界限,输入和输出价格都会直接提高5倍。

这也让Token效率本身变得越来越重要。随着AI模型价格持续下降,开发者过去只需要关注“每百万Token多少钱”,现在还必须考虑模型完成相同任务究竟需要消耗多少Token。一个单价更低但需要生成更多Token才能完成任务的模型,最终实际成本未必始终更低。

Anthropic目前已经在Claude平台以及Amazon Web Services、Google Cloud和Microsoft Foundry等渠道提供Haiku 5.5,同时也将其加入Claude Code。普通用户则可以在Claude的网页、iOS和Android应用中使用Haiku 5.5。

从整个Claude 5.5产品线来看,Anthropic已经形成了相对明确的分工:Opus 5.5负责最复杂的推理和Agent任务,Sonnet 5.5承担性能与成本之间的平衡,而Haiku 5.5则进一步向高并发、低延迟和低成本场景下沉。

因此,Haiku 5.5真正具有竞争力的地方并不只是“便宜”,而是Anthropic试图用更低的单价,把一个具备较强推理和Agent能力的模型推向大规模调用场景。不过,新的Token计量方式以及10万Token后的价格跳升,也意味着企业在部署之前必须结合实际工作负载计算总成本,而不能只看宣传中的每百万Token价格。

如果AI Agent未来进一步普及,大量模型调用将从今天的一次问答变成几十次甚至数百次连续调用。在这种情况下,单次调用的价格、响应速度以及Token消耗效率都会直接影响整个AI系统的运营成本。Haiku 5.5正是在这一背景下推出,其真正的目标很可能并不是成为最强大的Claude模型,而是成为Anthropic整个AI生态中承担最大调用量的“低成本发动机”。

关联标签

相似文章

评论

0/500
验证码(点击图片刷新)
暂无评论