跳到正文
原文
MarkTechPost(RSS)· Michal Sutter·· 2 小时前精选AI 评分79

OpenAI 发布 GPT-6.1 Sol:以 Astra 五分之一价格接近其编码与计算机操作水平

OpenAI Releases GPT-6.1 Sol: Near-Astra Coding and Computer Use at One-Fifth of Astra’s Token Price

AI 导读

OpenAI 发布 GPT-6.1 Sol,定价为每百万 token 2 美元输入、10 美元输出、0.10 美元缓存输入,为 GPT-6 Astra 标准价格约五分之一。

推荐理由

原文整理了 GPT-6.1 Sol 的定价、上下文与各家厂商基准对比,便于开发者评估其相对 Astra 和 Claude 的性价比。

正文 · AI 翻译

本周,OpenAI 发布了 GPT-6.1 Sol。它是对 GPT-6 家族中端模型 GPT-6 Sol 的升级。OpenAI 的说法很具体:在智能体编程、计算机使用和专业工作方面接近 Astra 的结果。价格是 GPT-6 Astra 标准输入和输出费率的五分之一。缓存输入降至每百万 token 0.10 美元,比 GPT-6 Sol 低 50%。

它可以部署吗?可以,作为托管模型。它今天已在 OpenAI API 中上线,代号为 gpt-6.1-sol,并可在 ChatGPT Work 和 Codex 中使用。

Sol 在 GPT-6 阵容中的位置

OpenAI 目前提供 3 个 GPT-6 层级。GPT-6 Astra 每百万 token 收费为输入 10 美元、输出 50 美元、缓存输入 1 美元。GPT-6.1 Sol 为 2 美元、10 美元和 0.10 美元。GPT-6 Luna 为 0.10 美元、0.50 美元和 0.01 美元。

缓存价格对智能体来说相当重要。智能体在每一步都会重新发送相同的系统提示、工具模式和对话历史。现在缓存读取费用为未缓存输入费率的 5%,低于 GPT-6 Sol 的 10%。

基准测试结果

以下所有数据均为 OpenAI 在发布文章中报告的厂商数据。OpenAI 表示,竞争对手的数据来自公开报告。

  • 编程:在 DeepSWE v1.1 上,GPT-6.1 Sol 以约五分之一的成本达到 GPT-6 Astra 的水平。它以更低的推理努力,比 GPT-6 Sol 的最佳成绩高出 6.4 个百分点。
  • 专业工作:在 GDP.pdf 上,该测试针对复杂专业 PDF 的问答,Sol 击败了带 fallback 的 Claude Opus 5.5。其每任务成本不到后者的一半。在 AutomationBench 1.0.6 上,Sol 在中等努力下比 Opus 5.5 高 2.2 分。该结果成本约为后者的三分之一。
  • 计算机使用:在 OSWorld 2.0 离线集上,Sol 在最大努力下比 GPT-6 Sol 提升 7 分。其每任务成本约为 Astra 的七分之一,差距在 2.1 分以内。
  • 科学:在 Terminal-Bench Science 0.1 上,Sol 在最大努力下得分是 GPT-6 Sol 的两倍多。平均每任务成本为 5.47 美元,而 Opus 5.5 为 23.21 美元,Astra 为 23.80 美元。Astra 仍以 68.1% 领先,OpenAI 推荐将其用于最难的研究。
  • 事实性:在低努力下,包含事实错误的回答占比从 11.4% 降至 7.7%。这减少了约 32%。该评估使用了刻意设置的困难对话,其中用户曾标记过早期模型的错误。

开发者需要的 API 细节

来自 GPT-6.1 Sol 模型页面:

  • 上下文窗口为 1,050,000 token,最大输出 token 为 128,000,知识截止日期为 2026 年 4 月 30 日。
  • 文本和图像输入;文本输出。
  • reasoning.effort 接受 low、medium(默认)、high、xhigh 和 max。不支持 none 和 minimal 设置。
  • 使用 Responses API 进行工具调用。Chat Completions 可在不使用工具调用的情况下工作。
  • 超过 272K 输入 token 的提示词,整个请求的输入和缓存费率按 2 倍计算,输出按 1.5 倍计算。
  • Batch 和 Flex 便宜 50%。Fast 模式为标准价格的 2 倍。
  • 支持美国和欧盟数据驻留。Fast 模式在欧盟驻留下不可用。
  • 不支持微调。

OpenAI 还计划在几天内在 Codex 中推出 GPT-6.1 Sol Ultrafast 选项。它承诺 token 生成速度最高可达标准速度的 8 倍。

交互式讲解

GPT-6.1 Sol 对比

功能GPT-6.1 SolClaude Opus 5.5Claude Sonnet 5.5Gemini 3.1 Pro Preview
开发者 / API IDOpenAI / gpt-6.1-solAnthropic / claude-opus-5-5Anthropic / claude-sonnet-5-5Google / gemini-3.1-pro-preview
状态正式可用正式可用正式可用预览
输入价格(每 100 万)$2.00$4.00$2.00$2.00(≤200K 提示)
输出价格(每 100 万)$10.00$20.00$10.00$12.00(≤200K 提示)
缓存输入读取(每 100 万)$0.10$0.20$0.20$0.20 + $4.50/100 万 token/小时存储
长提示附加费>272K 输入:输入和缓存 2 倍,输出 1.5 倍无;100 万按标准费率无;100 万按标准费率>200K:输入 $4,输出 $18
上下文窗口1,050,000100 万100 万1,048,576
最大输出 token 数128,000128K128K65,536
输入模态文本、图像文本、图像文本、图像文本、图像、视频、音频、PDF
推理控制低到最高(5 档),默认中自适应思考,始终开启;默认中自适应思考;默认高支持思考
批量定价(输入 / 输出)标准价 5 折$2 / $10$1 / $5$1 / $6
知识截止日期2026 年 4 月 30 日2026 年 6 月2026 年 6 月未列出
开放权重否否否否

标准第一方 API 标价,核实于 2026 年 9 月 30 日。

Claude Sonnet 5.5 的标价与 Sol 的 $2 和 $10 一致,但 Sol 的缓存输入成本只有其一半。OpenAI 的基准测试将 Sol 与 Opus 5.5 对比,而非 Sonnet 5.5。Gemini 3.1 Pro 在输入价格上与 Sol 相同,输出收费 $12,且仍处于预览阶段。标价并非直接的成本比较。Anthropic 指出,其较新的分词器对相同文本会生成约多 30% 的 token。

关键要点

  • GPT-6.1 Sol 在 DeepSWE v1.1 上与 GPT-6 Astra 持平,成本约为其五分之一。
  • 定价为每 100 万 token 输入 $2、输出 $10、缓存输入 $0.10。
  • 在 AutomationBench 上,它以约三分之一的成本比 Claude Opus 5.5 高出 2.2 分。
  • 它提供 1,050,000 token 上下文、128K 输出和 5 档推理强度。
  • 它仅提供 API 且为闭源权重;Astra 仍在最难的科研任务上领先。

常见问题

  • 什么是 GPT-6.1 Sol? 它是 OpenAI 的中端 GPT-6 模型,于 2026 年 9 月 29 日发布,面向编程、计算机使用和专业工作。
  • GPT-6.1 Sol 多少钱? 标准 API 定价为每 100 万输入 token $2、缓存输入 $0.10、输出 $10。
  • 我可以自行托管 GPT-6.1 Sol 吗? 不可以。它仅通过 OpenAI API、ChatGPT Work 和 Codex 提供。

文章 OpenAI Releases GPT-6.1 Sol: Near-Astra Coding and Computer Use at One-Fifth of Astra’s Token Price 首发于 MarkTechPost。

来源:MarkTechPost(RSS) · marktechpost.com