OpenRouter 上的"AI 超市"效应:GPT-OSS 120b 流量达 Opus 4.8 的 36%,模型市场加速分层

Tomer Tunguz 博客(VC 分析)·2026-07-23 08:00·60天前
AI 导读

OpenRouter 上的 AI 模型市场正像超市货架一样分层:OpenAI 去年 8 月发布的开源模型 GPT-OSS 120b 仍占据 Anthropic 最新旗舰 Opus 4.8 流量的 36%。

Tomer Tunguz 博客(VC 分析)
精选
61AI 编辑部评分,满分 100

OpenRouter 上的"AI 超市"效应:GPT-OSS 120b 流量达 Opus 4.8 的 36%,模型市场加速分层

2026-07-23 08:00· 60天前
AI 导读

OpenRouter 上的 AI 模型市场正像超市货架一样分层:OpenAI 去年 8 月发布的开源模型 GPT-OSS 120b 仍占据 Anthropic 最新旗舰 Opus 4.8 流量的 36%。

推荐理由

Tomer用OpenRouter数据和自己的本地实验,把模型市场细分讲得很清楚,对选型有直接参考价值,做本地agent的可以看看他换掉Gemma的理由。

正文 · AI 翻译

1989 年,鲍里斯·叶利钦在休斯顿的一家 Randalls 超市前停下脚步,被琳琅满目的冰淇淋震惊了。1 OpenRouter 就是 AI 领域的那个超市货架。

而消费者的选择出人意料:OpenAI 一年前发布的开源模型 GPT-OSS 120b2 占据了 Anthropic 的 Opus 4.8 流量的 36%。3

为什么一个 2025 年 8 月的模型,仍然占据着一个几周前才发布的前沿模型三分之一的流量?

Token 市场已经细分了。

Daily tokens served on OpenRouter, 7-day average: GLM 5.2 tops the field at 495B, above Claude Opus 4.8 at 199.6B; a year-old GPT-OSS-120b holds 71.3B, roughly a third of Opus, with Gemma 4 26B at 50B & the rest of the open field trailing to Phi-4 at 90M

细分之所以发生,是因为买家需求各不相同。

这种细分正在竞争驱动下加速。上周 Anthropic 发布了 Opus 5,比 Fable 更小、更便宜,4 明确是为了争夺月之暗面 Kimi 3 所瞄准的市场。5 在中端模型市场,Poolside 推出了 Laguna S 2.1,一款美国中端市场模型。6

规模(小、中、大、XL)、来源(美国 vs 中国)、架构(稠密 vs 稀疏)、精度(专注编程还是通用)、速度(每秒 token 数)、模态(纯文本还是视觉);AI 有许许多多不同的风味。

我花了一个周末替换运行我的智能体的模型。现任是 Gemma 4 26b;挑战者是 Laguna S 2.1,一个 1180 亿参数的模型。按照我预期会起作用的每一项数字,这个 118b 模型本应更慢。

在我的 M5 Max 上,两者生成速度相同,因为 Laguna 是混合专家架构:1180 亿参数驻留在内存中,但每个 token 只激活 80 亿。一个 118b 模型现在以 26b 模型的解码成本运行,这把前沿级质量拉低到了本地层级。

准确率的提升体现在关键之处。我的本地技术栈运行一个编码与邮件智能体进行工具调用,而在我轮换使用过的各个模型中,随着激活参数上升,工具调用失败率从 29.4% 降至 20.1%。7 Laguna 相比它所替换的 26b 模型将错误率降低了 7 个百分点。

MCP tool-call failure rate for the local model driving a production automation stack, measured from real traffic: Ornith-1.0 35B at 29.4%, Gemma 4 26B at 27.1%, & Laguna S 2.1 at 20.1%, roughly a quarter fewer failures than Gemma

分层是一个健康竞争市场的标志。前沿仍然服务于世界上最难的 token。它不再需要服务所有 token,而我笔记本电脑上的层级刚刚获得了一个高得多的上限;这一趋势将被竞争不可阻挡地向前推进。


  1. 鲍里斯·叶利钦 1989 年造访休斯顿一家杂货店,1989 年 9 月 16 日,Clear Lake 的一家 Randalls。↩︎

  2. 推出 gpt-oss(OpenAI),发布于 2025 年 8 月 5 日。↩︎

  3. OpenRouter 模型活动页面,7 天平均值,检索于 2026-07-27:GPT-OSS-120bGLM 5.2Claude Opus 4.8↩︎

  4. Anthropic 以一半价格推出 Claude Opus 5,发布于 2026 年 7 月 24 日。↩︎

  5. 月之暗面的 Kimi 3 有望缩小与 Anthropic 的 Opus 4.8 之间的差距(TechCrunch)↩︎

  6. 推出 Laguna S 2.1(Poolside),一个总参数 118B、激活参数 8B 的开放权重模型,发布于 2026 年 7 月 22 日。↩︎

  7. 作者的生产数据:来自一个本地编码与邮件智能体的 MCP 工具调用日志,在五个月内跨三个本地模型测量。↩︎

来源:Tomer Tunguz 博客(VC 分析)· tomtunguz.com