Anthropic 发布 Claude Haiku 5.5,定价对齐 GPT-6 Luna 并附 API 积分
Claude Haiku 5.5
Anthropic 发布 Claude Haiku 5.5,价格与 GPT-6 Luna 对齐为 $0.10/$0.50(10 万 token 以内),超出后涨至 $0.50/$2.50。
同一新闻,精选展示《Anthropic 发布 Claude Haiku 5.5,运行成本平均降低约 75%》
正如之前所承诺的,这里是 Anthropic 全新的快速、低成本模型:Introducing Claude Haiku 5.5。
之前的 Haiku 4.5 已经明显显出老态。它发布于将近一年前,定价为每百万输入 token 1 美元、每百万输出 token 5 美元——即便在当时也算相对昂贵,而且是 OpenAI 上个月发布的 GPT-6 Luna 价格的整整 10 倍。
新的 Haiku 价格与 GPT-6 Luna 完全一致——0.10 美元/0.50 美元——最高 100,000 token。超过 100,000 token 后,价格上涨 5 倍,达到 0.50 美元/2.50 美元。Luna 本身在 272,000 token 时也会涨价,但只涨到 0.20 美元/0.75 美元。
Haiku 5.5 还使用了一个新的、更不划算的分词器。我的 Claude Token Counter 工具显示,同一段长提示词在 Haiku 5.5 下使用的 token 数大约是 Haiku 4.5 的 1.25 倍,所以这里存在一个隐性涨价。
如果你的工作负载能控制在 100,000 token 以内,Haiku 与 Luna 价格相同,而且报告的基准测试分数更高。超过 100,000 token 后,Luna 看起来划算得多。
llm-anthropic 的最新版本终于修复了这个问题,我不再需要为每个新模型都发布一个新版本的插件。我是这样测试新模型的:
llm install -U llm-anthropic
llm anthropic refresh
llm -m claude-haiku-5.5 "Generate an SVG of a pelican riding a bicycle" -o thinking_effort low
鹈鹕
这里是低、中、高、xhigh 和 max 档位的鹈鹕。新的 Haiku 不允许你禁用推理,默认档位为 medium。除了 low 之外,其他档位我都得到了一副不错的自行车车架。低 effort 的鹈鹕花费 0.0936 美分,耗时 7 秒。
这只 max effort 的鹈鹕生成耗时 5 分 9 秒,但只花了我 3.3826 美分:

作为对比,这是我一年前从 Haiku 4.5 得到的鹈鹕(花费 0.7583 美分——Haiku 4.5 不支持推理档位)。它画鹈鹕的水平糟透了:

以及面向订阅者的慷慨 API 额度方案
除了 Haiku 5.5,Anthropic 今天还宣布,他们将 Sonnet 5.5 的缓存读取价格减半。他们还为订阅计划增加了 API 额度:
第二,本周我们将向所有 Max 和 Team 订阅者推出每月 API 额度,可用于 Claude Platform。Max 5x 用户每月将获得 100 美元额度,Max 20x 用户将获得 200 美元,Team 订阅者将获得最高 500 美元,在其用户之间共享。
领取这一点非常方便:前往Settings -> Billing,选择每月应获得该额度的 API 组织:

API 额度与订阅本身的费用完全一致。这真的很慷慨——它让订阅者更容易使用 API。Anthropic 还允许你为 API 禁用自动充值,其结果是“当你的余额用尽时,API 请求将停止”——如果你打算烧掉这些 API 额度又不想遭遇令人不快的账单意外,这正是你想要的。
请注意,每月额度不会结转——不用就作废。
OpenAI 仍然允许你将 Codex 订阅用于个人 API 用途,这对重度 API 用户来说更划算。这一新的额度方案至少在一定程度上缩小了这一差距。
标签:ai、generative-ai、llms、anthropic、claude、llm-pricing、pelican-riding-a-bicycle、llm-release
来源:Simon Willison 博客 · simonwillison.net