OpenAI 发布 GPT-6.1 Sol:以 Astra 五分之一价格接近其编码与计算机操作水平
OpenAI Releases GPT-6.1 Sol: Near-Astra Coding and Computer Use at One-Fifth of Astra’s Token Price
OpenAI 发布 GPT-6.1 Sol,定价为每百万 token 2 美元输入、10 美元输出、0.10 美元缓存输入,为 GPT-6 Astra 标准价格约五分之一。
原文整理了 GPT-6.1 Sol 的定价、上下文与各家厂商基准对比,便于开发者评估其相对 Astra 和 Claude 的性价比。
本周,OpenAI 发布了 GPT-6.1 Sol。它是对 GPT-6 家族中端模型 GPT-6 Sol 的升级。OpenAI 的说法很具体:在智能体编程、计算机使用和专业工作方面接近 Astra 的结果。价格是 GPT-6 Astra 标准输入和输出费率的五分之一。缓存输入降至每百万 token 0.10 美元,比 GPT-6 Sol 低 50%。
它可以部署吗?可以,作为托管模型。它今天已在 OpenAI API 中上线,代号为 gpt-6.1-sol,并可在 ChatGPT Work 和 Codex 中使用。
Sol 在 GPT-6 阵容中的位置
OpenAI 目前提供 3 个 GPT-6 层级。GPT-6 Astra 每百万 token 收费为输入 10 美元、输出 50 美元、缓存输入 1 美元。GPT-6.1 Sol 为 2 美元、10 美元和 0.10 美元。GPT-6 Luna 为 0.10 美元、0.50 美元和 0.01 美元。
缓存价格对智能体来说相当重要。智能体在每一步都会重新发送相同的系统提示、工具模式和对话历史。现在缓存读取费用为未缓存输入费率的 5%,低于 GPT-6 Sol 的 10%。
基准测试结果
以下所有数据均为 OpenAI 在发布文章中报告的厂商数据。OpenAI 表示,竞争对手的数据来自公开报告。
- 编程:在 DeepSWE v1.1 上,GPT-6.1 Sol 以约五分之一的成本达到 GPT-6 Astra 的水平。它以更低的推理努力,比 GPT-6 Sol 的最佳成绩高出 6.4 个百分点。
- 专业工作:在 GDP.pdf 上,该测试针对复杂专业 PDF 的问答,Sol 击败了带 fallback 的 Claude Opus 5.5。其每任务成本不到后者的一半。在 AutomationBench 1.0.6 上,Sol 在中等努力下比 Opus 5.5 高 2.2 分。该结果成本约为后者的三分之一。
- 计算机使用:在 OSWorld 2.0 离线集上,Sol 在最大努力下比 GPT-6 Sol 提升 7 分。其每任务成本约为 Astra 的七分之一,差距在 2.1 分以内。
- 科学:在 Terminal-Bench Science 0.1 上,Sol 在最大努力下得分是 GPT-6 Sol 的两倍多。平均每任务成本为 5.47 美元,而 Opus 5.5 为 23.21 美元,Astra 为 23.80 美元。Astra 仍以 68.1% 领先,OpenAI 推荐将其用于最难的研究。
- 事实性:在低努力下,包含事实错误的回答占比从 11.4% 降至 7.7%。这减少了约 32%。该评估使用了刻意设置的困难对话,其中用户曾标记过早期模型的错误。
开发者需要的 API 细节
来自 GPT-6.1 Sol 模型页面:
- 上下文窗口为 1,050,000 token,最大输出 token 为 128,000,知识截止日期为 2026 年 4 月 30 日。
- 文本和图像输入;文本输出。
reasoning.effort接受 low、medium(默认)、high、xhigh 和 max。不支持 none 和 minimal 设置。- 使用 Responses API 进行工具调用。Chat Completions 可在不使用工具调用的情况下工作。
- 超过 272K 输入 token 的提示词,整个请求的输入和缓存费率按 2 倍计算,输出按 1.5 倍计算。
- Batch 和 Flex 便宜 50%。Fast 模式为标准价格的 2 倍。
- 支持美国和欧盟数据驻留。Fast 模式在欧盟驻留下不可用。
- 不支持微调。
OpenAI 还计划在几天内在 Codex 中推出 GPT-6.1 Sol Ultrafast 选项。它承诺 token 生成速度最高可达标准速度的 8 倍。
交互式讲解
GPT-6.1 Sol 对比
| 功能 | GPT-6.1 Sol | Claude Opus 5.5 | Claude Sonnet 5.5 | Gemini 3.1 Pro Preview |
|---|---|---|---|---|
| 开发者 / API ID | OpenAI / gpt-6.1-sol | Anthropic / claude-opus-5-5 | Anthropic / claude-sonnet-5-5 | Google / gemini-3.1-pro-preview |
| 状态 | 正式可用 | 正式可用 | 正式可用 | 预览 |
| 输入价格(每 100 万) | $2.00 | $4.00 | $2.00 | $2.00(≤200K 提示) |
| 输出价格(每 100 万) | $10.00 | $20.00 | $10.00 | $12.00(≤200K 提示) |
| 缓存输入读取(每 100 万) | $0.10 | $0.20 | $0.20 | $0.20 + $4.50/100 万 token/小时存储 |
| 长提示附加费 | >272K 输入:输入和缓存 2 倍,输出 1.5 倍 | 无;100 万按标准费率 | 无;100 万按标准费率 | >200K:输入 $4,输出 $18 |
| 上下文窗口 | 1,050,000 | 100 万 | 100 万 | 1,048,576 |
| 最大输出 token 数 | 128,000 | 128K | 128K | 65,536 |
| 输入模态 | 文本、图像 | 文本、图像 | 文本、图像 | 文本、图像、视频、音频、PDF |
| 推理控制 | 低到最高(5 档),默认中 | 自适应思考,始终开启;默认中 | 自适应思考;默认高 | 支持思考 |
| 批量定价(输入 / 输出) | 标准价 5 折 | $2 / $10 | $1 / $5 | $1 / $6 |
| 知识截止日期 | 2026 年 4 月 30 日 | 2026 年 6 月 | 2026 年 6 月 | 未列出 |
| 开放权重 | 否 | 否 | 否 | 否 |
标准第一方 API 标价,核实于 2026 年 9 月 30 日。
Claude Sonnet 5.5 的标价与 Sol 的 $2 和 $10 一致,但 Sol 的缓存输入成本只有其一半。OpenAI 的基准测试将 Sol 与 Opus 5.5 对比,而非 Sonnet 5.5。Gemini 3.1 Pro 在输入价格上与 Sol 相同,输出收费 $12,且仍处于预览阶段。标价并非直接的成本比较。Anthropic 指出,其较新的分词器对相同文本会生成约多 30% 的 token。
关键要点
- GPT-6.1 Sol 在 DeepSWE v1.1 上与 GPT-6 Astra 持平,成本约为其五分之一。
- 定价为每 100 万 token 输入 $2、输出 $10、缓存输入 $0.10。
- 在 AutomationBench 上,它以约三分之一的成本比 Claude Opus 5.5 高出 2.2 分。
- 它提供 1,050,000 token 上下文、128K 输出和 5 档推理强度。
- 它仅提供 API 且为闭源权重;Astra 仍在最难的科研任务上领先。
常见问题
- 什么是 GPT-6.1 Sol? 它是 OpenAI 的中端 GPT-6 模型,于 2026 年 9 月 29 日发布,面向编程、计算机使用和专业工作。
- GPT-6.1 Sol 多少钱? 标准 API 定价为每 100 万输入 token $2、缓存输入 $0.10、输出 $10。
- 我可以自行托管 GPT-6.1 Sol 吗? 不可以。它仅通过 OpenAI API、ChatGPT Work 和 Codex 提供。
文章 OpenAI Releases GPT-6.1 Sol: Near-Astra Coding and Computer Use at One-Fifth of Astra’s Token Price 首发于 MarkTechPost。
来源:MarkTechPost(RSS) · marktechpost.com