快速结论
Haiku 5.5 已由 Anthropic 正式发布。提示不超过 100k token 时,标准输入和输出分别为每百万 0.10、0.50 美元;超过该长度的费率更高,不能只看最低单价估算长上下文任务。
- 官方发布日期为 2026 年 10 月 7 日,Claude Platform 模型 ID 为 claude-haiku-5-5。
- 提示不超过 100k token:输入每百万 0.10 美元、输出 0.50 美元;超过 100k:输入 0.50 美元、输出 2.50 美元。
- Sonnet 5.5 缓存读取价格由每百万 token 0.20 美元降为 0.10 美元。
- 官方性能与任务成本数据属于厂商披露,并非本站独立评测。
本次更新:新增稿件;按 2026 年 10 月 8 日可核验来源整理,事实与编辑建议分别表述。
Anthropic 于 10 月 7 日正式发布 Claude Haiku 5.5,将它定位为处理摘要、分类、查询等高频任务的小模型,也可作为复杂工作流中的子代理。官方给出的模型 ID 为 claude-haiku-5-5。
提示长度决定费率档位
公告中的标准费率以每百万 token、美元计:
| 提示长度 | 输入 | 输出 | 缓存读取 |
|---|---|---|---|
| 不超过 100k token | 0.10 | 0.50 | 0.01 |
| 超过 100k token | 0.50 | 2.50 | 0.05 |
预算应分别统计输入、缓存读取和输出,并按实际提示长度核对档位;缓存写入另有计费项。以上是发布公告费率,具体渠道和处理方式仍须以对应服务的价格表为准。
Sonnet 缓存同步调整
Anthropic 同时宣布,Sonnet 5.5 的缓存读取价格从每百万 token 0.20 美元降至 0.10 美元。对大量复用长系统提示和工具描述的任务,这一变化值得重新计算预算。公司披露的平均任务成本下降包含其样本分布与 token 使用变化,不能直接套成每个项目都能获得同样降幅。
对模型选型的启发
**编辑建议:**把批量摘要、标签分类与复杂规划分开评估。先用固定业务样本比较正确率、人工返工和单任务账单,再决定是否把简单步骤交给较小模型。与 DeepSeek 方案比较时,也应对齐上下文长度、缓存命中、输出规模、工具轮数和完成标准。
本文是发布与计费快讯,未进行 Haiku 5.5 的付费调用或横向实测。
参考资料
本文依据以下资料整理,版本与接口信息请以来源页面的现行说明为准。