Anthropic 于 2026 年 10 月 7 日推出 Claude Haiku 5.5。提示词不超过 10 万个词元时,输入价格为每百万个词元 0.10 美元;超过这一长度则为 0.50 美元。公司将这款模型定位于高频任务和 AI 智能体;具体请求的成本取决于其长度及处理的词元数量。

面向高频、特定任务的模型
在 10 月 7 日的公告中,Anthropic 列举了摘要生成、上下文压缩(compaction)、分类和数据库查询等用途。Haiku 5.5 也可作为子智能体,负责编码工作中的特定步骤;文档还提到了客户支持和浏览器任务。Claude Platform 上的模型 ID 为 claude-haiku-5-5。
Anthropic 称,在标准速度模式的比较中,Haiku 5.5 是其速度最快的模型;Opus 在 Fast Mode 下运行得更快。它也是 Haiku 系列中首个支持调节 effort 的模型,用户可选择侧重成本或推理质量的设置。编辑部未进行独立测试,因此速度和质量方面的评价仍属于公司说法。
词元价格
Claude Platform 的定价按每百万个词元计算。价格档位取决于提示词长度:
| 项目 | 不超过 10 万个词元 | 超过 10 万个词元 | Haiku 4.5 |
|---|---|---|---|
| 输入词元 | 0.10 美元 | 0.50 美元 | 1 美元 |
| 输出词元 | 0.50 美元 | 2.50 美元 | 5 美元 |
| 缓存读取 | 0.01 美元 | 0.05 美元 | 0.10 美元 |
| 缓存写入(5 分钟) | 0.125 美元 | 0.625 美元 | 1.25 美元 |
与 Haiku 4.5 相比,提示词不超过 10 万个词元时,词元价格降低了 90%;超过这一门槛后则降低 50%。Anthropic 还估算,完成工作的平均成本约降低 75%。这项公司估算考虑了请求的分布,以及更新后的分词器;后者完成同一任务时会使用稍多一些的词元。因此,平均估算并不意味着每个请求都能节省同等比例的成本。

适用范围与相关变化
对于复杂的智能体编程,Anthropic 建议使用更高级的 Sonnet 5.5 或 Opus 5.5;Haiku 5.5 则适用于摘要生成和子智能体工作等更具体的环节。按工作类型分配模型,有助于区分成本:频繁的短操作可以交给较小的模型,而复杂任务则留给更高级的模型。
同一公告称,自 10 月 7 日起,Sonnet 5.5 的缓存读取价格已从每百万个词元 0.20 美元降至 0.10 美元。Anthropic 表示,这一变化使大多数智能体任务的成本降低约 20%。公司还称 Haiku 5.5 已在 Claude Platform、AWS、Google Cloud 和 Azure 上提供;编辑部未单独核实其在各第三方平台上的可用性。
Anthropic 承诺从 10 月 7 日当周开始,逐步向 Max 和 Team 订阅用户提供每月 API 额度。截至 10 月 8 日的核查时,尚未确认推广已完成。对团队而言,此次发布带来的实用建议是:先对照 10 万个词元的门槛检查提示词长度,再用自己的任务和成本测试合适的模型。