文章

Claude Haiku 5.5 降价 90%?10 万 token 门槛才是账单关键

看到“Claude Haiku 5.5 价格降低 90%”,很容易以为以后所有 Claude 任务都只要原来十分之一的钱。真正影响账单的,却是标题里不太显眼的另一条规则:输入超过 10 万 token,整次请求会进入另一档费率。

Anthropic 在 2026 年 10 月 7 日发布 Haiku 5.5,主打摘要、分类、信息提取等数量大、单次范围较小的工作。它也可以为较大的模型承担辅助任务。相比一味追逐最强旗舰,这次发布更接近一个商业问题:哪些工作终于便宜到可以经常做了?

10 万 token,为什么会突然改变费用?

token 是模型处理文字等内容时使用的计数单位,并不等于一个汉字。下面是核查于北京时间 10 月 9 日的Claude 官方标准 API 定价,单位均为美元/百万 token,不含其他收费项或优惠。

收费项目 Haiku 5.5:输入不超过 10 万 Haiku 5.5:输入超过 10 万 Haiku 4.5
普通输入 0.10 0.50 1.00
输出 0.50 2.50 5.00
缓存命中读取 0.01 0.05 0.10

短输入档的普通输入、输出单价,确实比 Haiku 4.5 低 90%;长输入档则低 50%。这是每个 token 的价格比较,还不是完成同一件工作的实际省钱比例。

门槛按每次请求的全部输入计数,包含缓存读取和写入。超过后,不是只给多出来的部分加价;这次请求的输入、输出等项目都采用对应的高档价格。此前已经完成的请求不会被追溯改价。

Haiku 5.5 假设请求费用随输入长度变化,超过十万 token 时采用更高费率

图:本站根据官方定价绘制的原创计算示意,非实测。固定输出 1000 token,忽略缓存、工具、重试、税费及其他优惠;核查日期为北京时间 2026 年 10 月 9 日。

举一个刻意靠近门槛的算术例子:输入 100000 token、输出 1000 token,费用是 0.0105 美元;输入只增加到 100001 token,输出保持不变,按另一档计算约为 0.0525 美元。这个例子用来说明规则,不能代表真实任务平均花费。

它对长对话尤其重要。你的最后一句提问可能很短,但请求还带着系统说明、工具定义、历史材料和返回结果。是否超过门槛,需要看整个请求,而不是只数刚输入的那一段话。

换了模型,也换了“尺子”

Haiku 5.5 迁移指南提醒,新版使用不同的分词器,同样文本的 token 数大约增加 30%,实际幅度取决于内容。因此,不能拿 Haiku 4.5 的历史计数,直接乘上 5.5 的新价格。

这也解释了为什么“单价低 90%”与发布稿所说“平均运行成本约低 75%”不是同一个口径。后者是厂商考虑实际消耗后的估计,不能当成每个用户都会获得的折扣,更不能只凭新单价重算旧账单。

对于接近 10 万门槛的材料,重新计数还有第二层意义:同一份文字换了计数方式,可能进入不同价格档。迁移需要重新核算输入长度与输出预算,而不只是替换模型名称。

小模型该接什么活,才是降价的意义

设想一个客服系统每天收到很多工单:先识别产品、提取订单号、判断问题属于退款还是技术支持。这类输出范围明确、容易检查的工作,适合尝试由较小模型处理。需要理解复杂纠纷或跨文件修改代码时,再交给能力更强的模型。这里是工作分工的假设例子,并非本站对 Haiku 的实测。

Haiku 5.5 首次引入 Haiku 系列的 effort 档位,也就是控制推理投入的设置。官方提示指南把 medium 作为默认档;low 更省、更快,但在长智能体任务里更容易漏掉搜索、检查或提前停止。高档位会带来更长的推理和回复,不能默认“开到最大最划算”。

真正该比较的,是完成一项合格任务的成本。一个便宜请求如果连续失败,随后还要重做,低单价并没有自动变成低总价。Anthropic 的成本分析文档也强调,模型选择要看任务难度和失败后的消耗,而不是只看价格表。

发布稿仍把 Sonnet 5.5、Opus 5.5 视为复杂智能体编程的更合适选择。Haiku 的降价给更多细小工作留下了预算,并不证明它已经替代整个模型梯队。

同期还有两项费用变化

首先,Sonnet 5.5 的缓存读取从每百万 token 0.20 美元降到 0.10 美元。这个变化主要影响反复使用相同上下文的工作;普通输入、输出单价不是一起减半。想了解缓存怎样改变长期任务费用,可以接着看站内Opus 5.5 成本拆解。

其次,Max 和 Team 订阅新增每月 API 赠额。按官方领取与使用规则,Max 5x 为 100 美元,Max 20x 为 200 美元;Team 按席位计算后汇入团队余额,每月上限 500 美元,并非所有团队自动得到 500 美元。新订阅者需满足七天条件,再关联符合权限要求的 Console 组织领取;开放会分批进行。

这笔赠额用于 Claude Platform,未用完不会滚存。它与 Claude、Claude Code、Cowork 的订阅用量分开,不能当成这些产品额外用量的充值,也不覆盖 Bedrock、Vertex AI 或 Foundry 的费用。

这次新闻最值得关注的,是 AI 厂商开始同时调整小模型价格、缓存成本和开发预算。对真正使用这些服务的人来说,先认清自己的任务长度、推理投入和计费渠道,比看到“降价 90%”就直接更换全部工作流更有价值。

本文除发布稿外,补充核查了上文链接的标准定价、迁移指南、提示指南、任务成本分析及 Max/Team API 赠额说明,共 5 份独立页面。技术规则以原始文档为依据,未自行复现厂商性能测试。

评论

搜索文章

正在加载搜索…