OpenAI GPT-5.6 周四发布,此前因美国政府强制延迟

The Decoder:AI News(RSS)·2026-07-08 16:00·74天前·Matthias Bastian
AI 导读

OpenAI GPT-5.6 模型于周四发布。该模型6月底亮相,最初因美国政府限制仅向部分合作伙伴提供,商务部在AI标准与创新中心完成额外测试后批准公开。OpenAI公开批评延迟,称将最佳工具与开发者及企业隔离。新模型Sol在TerminalBench 2.1得分88.8%,Sol Ultra达91.9%,高于Anthropic的Claude Mythos 5(88%)。在网络安全任务中,Sol与Mythos 5水平相当但仅用三分之一的token。Sol定价$5/$30每百万输入/输出token,Anthropic的Fable 5为$10/$50。

The Decoder:AI News(RSS)
精选
74AI 编辑部评分,满分 100

OpenAI GPT-5.6 周四发布,此前因美国政府强制延迟

2026-07-08 16:00· 74天前· Matthias Bastian
AI 导读

OpenAI GPT-5.6 模型于周四发布。该模型6月底亮相,最初因美国政府限制仅向部分合作伙伴提供,商务部在AI标准与创新中心完成额外测试后批准公开。OpenAI公开批评延迟,称将最佳工具与开发者及企业隔离。新模型Sol在TerminalBench 2.1得分88.8%,Sol Ultra达91.9%,高于Anthropic的Claude Mythos 5(88%)。在网络安全任务中,Sol与Mythos 5水平相当但仅用三分之一的token。Sol定价$5/$30每百万输入/输出token,Anthropic的Fable 5为$10/$50。

推荐理由

被美国政府按了暂停键的 GPT-5.6 终于要公开了,基准测试小胜 Claude Mythos 5 且 token 消耗仅三分之一,价格也比 Anthropic 便宜近半,开发者可以准备预算了。

正文 · AI 翻译

OpenAI 的 GPT-5.6 系列模型将于周四发布。 这些模型于 6 月底亮相,最初在美国政府的压力下仅限部分合作伙伴使用。据 Axios 报道,在人工智能标准与创新中心进行了额外测试后,美国商务部批准了公开发布。OpenAI 公开批评了这一限制,称其让开发者和企业无法获得最好的工具。正如特朗普最新的 AI 行政令所呼吁的那样,针对此类模型发布的具有约束力的标准至今仍不存在。

GPT-5.6 Sol Ultra 以 91.9% 的成绩在 TerminalBench 2.1 编程基准测试中拔得头筹。Claude Mythos 5 达到 88.0%,而 Google 的 Gemini 3.1 Pro Preview 以 70.7% 垫底。| 图片:OpenAI

OpenAI 表示,Sol 在多项基准测试中击败了 Anthropic 的 Claude Mythos 5。在 TerminalBench 2.1 上,Sol 得分 88.8%,Sol Ultra 达到 91.9%,Mythos 5 则为 88%。在网络安全任务上,Sol 与 Mythos 5 持平,但仅使用了三分之一的 token。Sol 的价格为每百万输入/输出 token 5 美元/30 美元。Anthropic 的 Fable 5 价格几乎翻倍,为 10 美元/50 美元,而且 很可能消耗的 token 也更多

来源:The Decoder:AI News(RSS)· the-decoder.com