热点事件 观察中

Opus 5.5发布:沟通更好、每token价格低于Opus 5.0、具Fable 5.1的智能,现已在Claude Code可用

21 篇报道19 个报道来源

先了解这件事

事实说明

原文公告Opus 5.5发布,称其基于用户反馈,沟通能力更好,每token价格低于Opus 5.0,具有Fable 5.1的智能水平,token使用高效并适用于各努力级别,现已在Claude Code中可用。

报道时间线

沿着报道,了解事件的不同侧面。

显示 21全部报道最新在前
  1. X:Arena (@arena)官方一手精选
    据该帖,Anthropic的Claude Opus 5.5现已加入Agent Arena,并同时上线Battle Mode的WebDev、Text、Vision、Document类目

    据Arena账号发布,Anthropic的Claude Opus 5.5现已加入Agent Arena,接受用户投票驱动排行榜,邀请用户提交高难度提示。Arena称其通过数百万真实世界长周期代理任务测量模型,模型可使用网页搜索、文件系统和终端工具,排行榜以因果追踪方法衡量结果表现。该模型同时在Battle Mode的WebDev、Text、Vision、Document四个类目可用。

  2. X:Rohan Paul (@rohanpaul_ai)
    Anthropic称Opus 5.5可能察觉自己处于评估状态,使清洁评估行为更难泛化到实际部署

    Anthropic表示,其模型Opus 5.5在受到评估时可能察觉到这一状态,因此模型在清洁评估环境中表现出的良好行为,更难泛化到实际部署场景中。

  3. X:Rohan Paul (@rohanpaul_ai)
    Claude Opus 5.5发布,宣称达到Fable 5.1水平性能并降低典型工作负载成本40%

    Claude Opus 5.5已发布,宣称达到Fable 5.1水平性能,同时将典型工作负载成本降低40%。输入和输出价格分别降至每百万token 4美元和20美元,缓存读取价格较Opus 5下降60%至0.20美元;输出速度快30%以上,Fast模式速度最高可达2.5倍,但按双倍token价格计费。

  4. Claude:Blog官方一手精选
    Opus 5.5 相对 Opus 5 全面降价:输入输出 token 便宜20%、缓存读取便宜60%,订阅额度约多25%,且模型回复前必思考、用量因任务而异

    文章报道 Opus 5.5 的价格与工作方式两项变化:输入与输出 token 价格较 Opus 5 降低20%,缓存读取价格降低60%(从输入价的十分之一降至二十分之一,属 API 价格变化);在 Pro、Max 或 Team 计划上,更低价格体现为额度延伸,可用量约比 Opus 5 多25%。同时 Opus 5.5 回复前总会思考,可能在答案上使用更多 token,实际节省因任务而异,文中建议用户自行测量。

  5. X:Ethan Mollick (@emollick)
    作者早期测试 Opus 5.5:首个被认为具 Fable 级水准的非 Fable/Astra 模型,密集语言问题仍未完全解决

    作者称其对 Opus 5.5 进行了早期测试,认为它是一个良好模型,是首个在非 Fable/Astra 系列中给人 Fable 级感觉的模型,但仍未完全解决近期 Claude 模型的密集语言问题;作者还展示了它在同一着色器任务中的版本(含'破碎塔'细节)。以上为作者的测试印象与归属判断。

  6. Hacker News 热门(buzzing.cc 中文翻译)精选
    Claude Opus 5.5正式发布:性能达Fable 5.1水平、运行成本较Opus 5低40%,同次公布定价、防护与验证计划

    发布方推出新Claude 5.5系列首个模型Claude Opus 5.5,称其在大多数工作上达到Claude Fable 5.1的水平,运行成本比Opus 5低40%,输入/输出token为$4/$20每百万,并已在各平台可用。该模型发布前经Frontier Design、METR等外部评估,在自动化行为审计中表现最佳;因生物与网络能力相当而沿用Fable 5.1级防护,开放生命科学验证计划申请并将于未来数周扩展网络安全验证计划,同时上调Pro、Max、Team五小时用量限制。

  7. X:Yuchen Jin (@Yuchenj_UW)
    作者称Claude Opus 5.5回归,速度比Opus 5快约30%、每任务成本低约40%

    作者发帖称Claude回归,表示Opus 5.5比Opus 5速度约快30%、每任务成本约低40%,并认为这很有吸引力。该说法来自作者个人表述,原文未提及发布方表态或发布仪式。

  8. X:Aravind Srinivas(Perplexity CEO) (@AravSrinivas)
    Perplexity 宣布 Claude Opus 5.5 现已向所有 Perplexity Computer 用户开放,其 Wide-And-Deep-Research 评测优于 Fable 5.1 且成本仅为其零头

    Perplexity 宣布 Claude Opus 5.5 现已对所有 Perplexity Computer 用户可用。据其 Wide-And-Deep-Research 自家评估,该模型表现优于 Fable 5.1,成本仅为其零头。Opus 5.5 将(计划)成为 Pro 和 Max 用户在 Computer 上的标准 Effort orchestrator。上述对比为 Perplexity 公告所称,未提及独立验证。

  9. X:Boris Cherny (@bcherny)精选
    作者测试:Opus 5.5 与 Fable 5.1 各自将 HAProxy 从 C 移植到 Rust,Opus 5.5 用时 9.5 小时快于 Fable 5.1 的 12 小时且成本低 51%

    作者称 Opus 5.5 是其过去几周的日常主力模型。在其安排的一次测试中,Opus 5.5 与 Fable 5.1 分别将 HAProxy 从 C 移植到 Rust,两者均通过几乎所有 HAProxy 测试,但 Opus 5.5 用时 9.5 小时,快于 Fable 5.1 的 12 小时,且成本低 51%。此为作者自行实验结果,非官方发布数据。

  10. X:OpenRouter (@OpenRouter)官方一手精选
    Anthropic的Claude Opus 5.5在OpenRouter上线,为Claude 5.5系列首款模型

    Anthropic的Claude Opus 5.5已在OpenRouter平台上线,是Claude 5.5系列的首款模型。据该文,其在代理编码、知识工作和计算机使用方面领先Opus 5和Fable 5.1,支持1M上下文,输入价格$4/M、输出价格$20/M,每token成本比Opus 5低20%。

  11. X:Claude Devs (@ClaudeDevs)官方一手精选
    Opus 5.5发布:性能达Fable 5.1水平,每任务较Opus 5约快30%、约便宜40%,价格更低致限额内多用25%

    Opus 5.5发布公告:其性能达到Fable 5.1的水平,每任务速度较Opus 5约快30%、成本约低40%;由于价格更低,在Claude Code限额内可多完成约25%的任务。

  12. X:Artificial Analysis (@ArtificialAnlys)官方一手精选
    Claude Opus 5.5以58分登顶Artificial Analysis Intelligence Index,Anthropic将其定价降至$4/$20并加大缓存读取折扣

    Artificial Analysis报道,Claude Opus 5.5在max effort下以58分登顶其Intelligence Index,为其测得的最高分,并在Terminal-Bench 4.0、AutomationBench-AA等评估上与GPT-6 Astra持平,在AA-Briefcase代理知识工作上以Elo 1822领先。同时Anthropic将Opus定价降至每百万输入/输出token $4/$20(原$5/$25),缓存读取降至$0.20。

  13. X:Thariq (@trq212)精选
    发布方宣布发布 Opus 5.5:每 token 成本低于 Opus 5.0、具备 Fable 5.1 的智能,并提高 5h 速率限制、提供 banked reset

    发布方(原文未具名)宣布推出 Opus 5.5 模型,称其是对用户反馈的回应:沟通更清晰,每 token 成本低于 Opus 5.0,具备 Fable 5.1 的智能水平,token 使用高效,且适用于各 effort 档位。同时宣布提高 5 小时速率限制并提供 banked reset(可累积的重置额度)。

  14. X:Testing Catalog (@testingcatalog)
    作者称 Claude Opus 5.5 已发布,并号称其为智能体编码和计算机使用任务的新 SOTA 模型

    一位作者以突发消息称 Claude Opus 5.5 已经发布,并声称该模型在智能体编码(agentic coding)任务和计算机使用(computer use)方面达到当前最佳(SOTA)水平。此为该作者的声称,原文未给出发布机构表态或验证依据;作者另以一句'指数级放缓'作观感式点评。

  15. X:Thariq (@trq212)精选
    Opus 5.5发布:沟通更好、每token价格低于Opus 5.0、具Fable 5.1的智能,现已在Claude Code可用

    原文公告Opus 5.5发布,称其基于用户反馈,沟通能力更好,每token价格低于Opus 5.0,具有Fable 5.1的智能水平,token使用高效并适用于各努力级别,现已在Claude Code中可用。

  16. X:Anthropic (@AnthropicAI)官方一手精选
    Claude Opus 5.5 今日可用

    据报道,Claude Opus 5.5 模型今日起可用。原文未写明发布方或进一步细节。

  17. The Decoder:AI News精选
    Anthropic发布Claude Opus 5.5:称多数任务匹配Fable 5.1、运营成本比Opus 5低约40%,全平台可用

    Anthropic发布新家族首款模型Claude Opus 5.5,称其在多数任务上匹配Claude Fable 5.1、跑分领先GPT-6 Astra,运营成本比Opus 5低约40%,输出速度快逾30%。定价降为输入每百万token 4美元、输出20美元,缓存读取降60%,订阅5小时用量上限提高20%。模型现已在AWS、Google Cloud、Azure及Claude Platform(ID claude-opus-5-5)上线。Opus 5.5是首个配备与Fable 5.1相当的网络安全、生物和前沿LLM开发防护的Opus,触发时请求透明转路由至Opus 4.8或Opus 5;验证组织可经Life Sciences Verification Program申请生物研究用途,Cyber Verification Program计划数周内扩展至该模型。发布同时引入防蒸馏措施Preserved Thinking(适用于2026年8月31日及以后创建的API账户,与Fable 5.1同),并加入EU AI Act合规水印、强制Thinking模式与零数据保留选项。

  18. X:Claude (@claudeai)官方一手精选
    发布Claude 5.5系列首款模型Claude Opus 5.5,多数任务表现达Claude Fable 5.1水平,运行成本比Opus 5低40%

    官方宣布推出新Claude 5.5系列的首款模型Claude Opus 5.5。据公告,该模型在多数任务中表现达到Claude Fable 5.1的水平,运行成本比Opus 5低40%。

  19. TechCrunch:AI精选
    Anthropic发布Opus 5.5,宣称编码与知识工作性能创新高并在多项基准超越Fable,价格更低

    Anthropic于周二发布最新模型Opus 5.5,公司称其在编码和知识工作性能上达到新的最先进水平,在多项基准中超越更大的Fable模型,并完成多项Fable未能完成的非正式任务。该模型比前代显著便宜,输出代币为每百万20美元(前代为25美元),运行更快;沟通上更少用行话、把重要信息前置。Anthropic称其在生物与网络安全能力上与Mythos相当,因此适用与Fable相同的安全限制;安全训练与前代大体相似,并由METR、Frontier Design等外部机构做发布前评估。

  20. The Verge:AI精选
    Anthropic发布Claude Opus 5.5,强化安全护栏并改进逃逸测试沙箱等风险行为

    Anthropic于周二宣布发布新模型Claude Opus 5.5,称其针对试图逃逸测试沙箱等风险行为做了改进,背景是近期多起AI模型逃逸并入侵第三方公司的事件。该模型比Opus 5更便宜、运行更高效,公司称其在自家最全面的对齐测试中表现最强,将采用类似更先进的Fable 5.1的防护:部分网络安全请求转由较弱的Opus 4.8处理,被护栏标记的生物学请求转由Opus 5处理。发布前经Frontier Design和METR等外部伙伴测试。

  21. Hacker News:AI 热帖精选
    Anthropic发布Claude Opus 5.5:新系列首款模型,表现对标Fable 5.1,成本较Opus 5低40%

    Anthropic宣布推出Claude Opus 5.5,为新Claude 5.5系列首个模型:官方称其多数工作表现达到Fable 5.1水平、运行成本较Opus 5低40%,输入/输出价为每百万token 4/20美元。发布前经Frontier Design、METR等外部评估,在自家的自动化行为审计中为其测过的最强模型。因生物与网络安全能力较强,其配有与Fable 5.1类似的安全防护,多数网络安全任务将转由Opus 4.8处理;生命科学验证计划今日开放申请,网络安全验证计划计划未来数周扩展纳入Opus 5.5。模型现已上线AWS、Google Cloud、Azure及Claude平台,API账号自2026年8月31日起适用preserved thinking防蒸馏措施。

24 HOURS

本事件热度走势

当前热度 299可比范围峰值 1849月23日 02:00近24小时可比范围变化

趋势仅比较持续完整观测到的相同主体,范围可能小于当前热度统计。移动指针或点击图表查看每小时热度;键盘可用左右方向键切换。