Anthropic 发布 Claude Haiku 5.5:1M 上下文,输入每百万 token 0.10 美元
Anthropic Releases Claude Haiku 5.5: A Small Model With 1M Context Priced at $0.10 per Million Input Tokens
Anthropic 发布 Claude Haiku 5.5,为目前最便宜最快的小模型,1M 上下文窗口、最高 128K 输出,10 万 token 以内输入每百万 0.10 美元、输出 0.50 美元,比 Haiku 4.5 低约 90%。
同一新闻,精选展示《Anthropic 发布 Claude Haiku 5.5,运行成本平均降低约 75%》
Anthropic 发布了 Claude Haiku 5.5,这是其迄今为止最便宜、最快的小型模型。它面向摘要、压缩、分类和子代理任务等高吞吐量工作。它保持 1M token 上下文窗口和最高 128K 输出 token。定价为每百万输入 token 0.10 美元起,每百万输出 token 0.50 美元起。对于不超过 100K token 的提示,这比 Claude Haiku 4.5 低 90%。
它可以部署吗?可以,作为托管 API。Haiku 5.5 已在 Claude API、Amazon Bedrock、Google Cloud、Microsoft Foundry 和 AWS 上的 Claude Platform 上正式可用。
Anthropic 发布了什么
Haiku 5.5 是首个具有可调 effort 设置的 Haiku 级模型。自适应思考默认开启,effort 参数默认为 medium。
它接受文本和图像,输出文本,知识截止日期为 2026 年 6 月。批处理作业在 beta 中支持最高 300K 输出 token。
需要注意两个关键点。非默认的 temperature、top_p 或 top_k 值会返回 400 错误。新的分词器还会将同一文本计为比 Haiku 4.5 多约 30% 的 token。迁移指南涵盖了两者。
定价:两级结构
定价在 100K 提示 token 处划分。不超过 100K 时,输入每百万 token 0.10 美元,输出 0.50 美元。缓存读取为 0.01 美元,5 分钟缓存写入为 0.125 美元。超过 100K 后,费率升至输入 0.50 美元、输出 2.50 美元。
Haiku 4.5 收费为输入 1 美元、输出 5 美元。Anthropic 表示约 90% 的 Haiku 4.5 请求保持在 100K token 以下。在针对分词器进行调整后,其估计 Haiku 5.5 平均便宜约 75%。批处理再降低 50%。
GPT-6 Luna 列出了相同的短上下文费率。其更高档位仅在超过 272K 输入 token 时开始,为 0.20 美元和 0.75 美元。对于 150K token 的提示,Luna 的标价更便宜。
基准测试
以下所有数据均为 Anthropic 报告(见系统卡):
- OSWorld 2.1(离线子集):72.4%,而 GPT-6 Luna 为 48.9%,Haiku 4.5 为 15.7%。
- Terminal-Bench 4.0:39.2%,而 Luna 为 16.4%,Haiku 4.5 为 0.0%。
- FrontierCode 1.1(Main):46.4%,而 Luna 为 42.4%。
- Humanity’s Last Exam:无工具 45.9%,有工具 57.4%。
- GDPval-AA v2.1:1620,而 Luna 为 1437,Haiku 4.5 为 735。
Sonnet 5.5 仍在每一行领先,包括 Terminal-Bench 4.0 上的 70.6%。Anthropic 自己推荐 Sonnet 5.5 和 Opus 5.5 用于复杂的代理式编码。
最佳用例
三种工作负载最适合 Haiku 5.5:
- 第一种是 Opus 5.5 或 Sonnet 5.5 下的子代理工作。在 Rogo,一个 Haiku 5.5 子代理提取 10-K 营收行,而更大的模型构建演示文稿。
- 第二种是高吞吐量文档问答和摘要。AlphaSense 在一个每周处理约 800 万次调用的功能上测试了它。
- 第三种是速度敏感的工作,如实时客户支持和浏览器使用。
Haiku 5.5 与最接近的竞争对手
| 功能 | Claude Haiku 5.5 | GPT-6 Luna | Gemini 3.5 Flash-Lite |
|---|---|---|---|
| 输入 / 输出(每 1M) | $0.10 / $0.50 | $0.10 / $0.50 | $0.30 / $2.50 |
| 长提示定价 | 超过 100K 后 $0.50 / $2.50 | 超过 272K 后 $0.20 / $0.75 | 统一费率 |
| 缓存读取(每 1M) | $0.01 | $0.01 | $0.03 + 存储 |
| 上下文窗口 | 1M token | 1,050,000 token | 1,048,576 token |
| 最大输出 | 128K tokens | 128,000 tokens | 65,536 tokens |
| 输入 | 文本、图像 | 文本、图像 | 文本、图像、视频、音频、PDF |
| 推理控制 | 自适应思考 + 努力程度(默认中等) | reasoning.effort 从 none 到 max(默认中等) | 支持思考 |
| 计算机使用 | SDK 支持(测试版) | 支持(Responses API) | 支持(预览版) |
| 批量折扣 | 50% | 50%(Batch 和 Flex) | 50% |
| 知识截止日期 | 2026 年 6 月 | 2026 年 5 月 18 日 | 模型页面未列出 |
| 运行位置 | Claude API、Bedrock、Google Cloud、Microsoft Foundry、AWS 上的 Claude Platform | OpenAI API | Gemini API |
来源: Anthropic 文档、Anthropic 公告、OpenAI 模型页面、OpenAI 定价、Google 模型页面、Google 定价。标准层级标价,核实于 2026 年 10 月 7 日。
交互式讲解
关键要点
- 对于不超过 100K tokens 的提示,每 1M tokens 输入 $0.10、输出 $0.50。
- 1M 上下文、128K 输出、带努力程度设置的自适应思考(默认
medium)。 - 在 OSWorld 2.1 上为 72.4%,而 Haiku 4.5 为 15.7%(Anthropic 报告)。
- 短上下文标价与 GPT-6 Luna 相同;超过 100K tokens 后 Luna 更便宜。
- 定位为 Opus 5.5 和 Sonnet 5.5 下的子代理,而非编码主力。
查看 技术细节。 所有功劳归于本项目的研究人员。另外,欢迎在 Twitter 上关注我们,别忘了加入我们的 150k+ ML SubReddit 并订阅 我们的新闻通讯。等等!你在 Telegram 上吗?现在你也可以在 Telegram 上加入我们了。
文章 Anthropic 发布 Claude Haiku 5.5:一款具有 1M 上下文、每百万输入 tokens 定价 $0.10 的小型模型 首次出现在 MarkTechPost 上。
来源:MarkTechPost · marktechpost.com