跳到正文
MarkTechPost· Michal Sutter·· 6 小时前同新闻AI 评分77

Anthropic 发布 Claude Haiku 5.5:1M 上下文,输入每百万 token 0.10 美元

Anthropic Releases Claude Haiku 5.5: A Small Model With 1M Context Priced at $0.10 per Million Input Tokens

AI 导读

Anthropic 发布 Claude Haiku 5.5,为目前最便宜最快的小模型,1M 上下文窗口、最高 128K 输出,10 万 token 以内输入每百万 0.10 美元、输出 0.50 美元,比 Haiku 4.5 低约 90%。

同一新闻,精选展示《Anthropic 发布 Claude Haiku 5.5,运行成本平均降低约 75%》

正文 · AI 翻译

Anthropic 发布了 Claude Haiku 5.5,这是其迄今为止最便宜、最快的小型模型。它面向摘要、压缩、分类和子代理任务等高吞吐量工作。它保持 1M token 上下文窗口和最高 128K 输出 token。定价为每百万输入 token 0.10 美元起,每百万输出 token 0.50 美元起。对于不超过 100K token 的提示,这比 Claude Haiku 4.5 低 90%。

它可以部署吗?可以,作为托管 API。Haiku 5.5 已在 Claude API、Amazon Bedrock、Google Cloud、Microsoft Foundry 和 AWS 上的 Claude Platform 上正式可用。

Anthropic 发布了什么

Haiku 5.5 是首个具有可调 effort 设置的 Haiku 级模型。自适应思考默认开启,effort 参数默认为 medium。

它接受文本和图像,输出文本,知识截止日期为 2026 年 6 月。批处理作业在 beta 中支持最高 300K 输出 token。

需要注意两个关键点。非默认的 temperature、top_p 或 top_k 值会返回 400 错误。新的分词器还会将同一文本计为比 Haiku 4.5 多约 30% 的 token。迁移指南涵盖了两者。

定价:两级结构

定价在 100K 提示 token 处划分。不超过 100K 时,输入每百万 token 0.10 美元,输出 0.50 美元。缓存读取为 0.01 美元,5 分钟缓存写入为 0.125 美元。超过 100K 后,费率升至输入 0.50 美元、输出 2.50 美元。

Haiku 4.5 收费为输入 1 美元、输出 5 美元。Anthropic 表示约 90% 的 Haiku 4.5 请求保持在 100K token 以下。在针对分词器进行调整后,其估计 Haiku 5.5 平均便宜约 75%。批处理再降低 50%。

GPT-6 Luna 列出了相同的短上下文费率。其更高档位仅在超过 272K 输入 token 时开始,为 0.20 美元和 0.75 美元。对于 150K token 的提示,Luna 的标价更便宜。

基准测试

以下所有数据均为 Anthropic 报告(见系统卡):

  • OSWorld 2.1(离线子集):72.4%,而 GPT-6 Luna 为 48.9%,Haiku 4.5 为 15.7%。
  • Terminal-Bench 4.0:39.2%,而 Luna 为 16.4%,Haiku 4.5 为 0.0%。
  • FrontierCode 1.1(Main):46.4%,而 Luna 为 42.4%。
  • Humanity’s Last Exam:无工具 45.9%,有工具 57.4%。
  • GDPval-AA v2.1:1620,而 Luna 为 1437,Haiku 4.5 为 735。

Sonnet 5.5 仍在每一行领先,包括 Terminal-Bench 4.0 上的 70.6%。Anthropic 自己推荐 Sonnet 5.5 和 Opus 5.5 用于复杂的代理式编码。

最佳用例

三种工作负载最适合 Haiku 5.5:

  • 第一种是 Opus 5.5 或 Sonnet 5.5 下的子代理工作。在 Rogo,一个 Haiku 5.5 子代理提取 10-K 营收行,而更大的模型构建演示文稿。
  • 第二种是高吞吐量文档问答和摘要。AlphaSense 在一个每周处理约 800 万次调用的功能上测试了它。
  • 第三种是速度敏感的工作,如实时客户支持和浏览器使用。

Haiku 5.5 与最接近的竞争对手

功能Claude Haiku 5.5GPT-6 LunaGemini 3.5 Flash-Lite
输入 / 输出(每 1M)$0.10 / $0.50$0.10 / $0.50$0.30 / $2.50
长提示定价超过 100K 后 $0.50 / $2.50超过 272K 后 $0.20 / $0.75统一费率
缓存读取(每 1M)$0.01$0.01$0.03 + 存储
上下文窗口1M token1,050,000 token1,048,576 token
最大输出128K tokens128,000 tokens65,536 tokens
输入文本、图像文本、图像文本、图像、视频、音频、PDF
推理控制自适应思考 + 努力程度(默认中等)reasoning.effort 从 none 到 max(默认中等)支持思考
计算机使用SDK 支持(测试版)支持(Responses API)支持(预览版)
批量折扣50%50%(Batch 和 Flex)50%
知识截止日期2026 年 6 月2026 年 5 月 18 日模型页面未列出
运行位置Claude API、Bedrock、Google Cloud、Microsoft Foundry、AWS 上的 Claude PlatformOpenAI APIGemini API

来源: Anthropic 文档、Anthropic 公告、OpenAI 模型页面、OpenAI 定价、Google 模型页面、Google 定价。标准层级标价,核实于 2026 年 10 月 7 日。

交互式讲解

关键要点

  • 对于不超过 100K tokens 的提示,每 1M tokens 输入 $0.10、输出 $0.50。
  • 1M 上下文、128K 输出、带努力程度设置的自适应思考(默认 medium)。
  • 在 OSWorld 2.1 上为 72.4%,而 Haiku 4.5 为 15.7%(Anthropic 报告)。
  • 短上下文标价与 GPT-6 Luna 相同;超过 100K tokens 后 Luna 更便宜。
  • 定位为 Opus 5.5 和 Sonnet 5.5 下的子代理,而非编码主力。

查看 技术细节。 所有功劳归于本项目的研究人员。另外,欢迎在 Twitter 上关注我们,别忘了加入我们的 150k+ ML SubReddit 并订阅 我们的新闻通讯。等等!你在 Telegram 上吗?现在你也可以在 Telegram 上加入我们了。

[赞助] Web 是大多数代理所缺失的那一个 API。数据库、日历和代码仓库都有 API。而开放 Web 大多没有。TinyFish MCP server 为任何 MCP 客户端提供四个工具:TinySearch、TinyFetch(将完整页面以 markdown 形式获取,包含 JavaScript)、用于登录和表单的 TinyBrowser,以及用于多步骤任务的 TinyAgent。Search 和 Fetch 免费。

文章 Anthropic 发布 Claude Haiku 5.5:一款具有 1M 上下文、每百万输入 tokens 定价 $0.10 的小型模型 首次出现在 MarkTechPost 上。

来源:MarkTechPost · marktechpost.com