Vercel AI Gateway 最近上线了一个模型榜单,把过去三个月的 Token、请求量和花费放在了一起。
几张图对着看,很有意思。一句话总结下“开放模型吃掉 Token,闭源模型拿走预算”。
开放权重模型占了 80.1% 的 Token,其中 DeepSeek V4.1 Flash 一款就占 64.8%。
但到了花费榜,排在前面的又变成了 Claude Opus、GPT-6 Astra、Kimi K3。 仅 Anthropic 和 OpenAI 两家,就拿走了 66.9% 的模型支出。
便宜模型在处理越来越多的工作,贵模型依然在拿走大部分预算。
再看团队覆盖率和主力模型,结果又分散了很多。 大家并没有把所有任务都交给同一个模型,而是在不同模型之间来回切换。
这就是未来模型市场慢慢稳定下来的样子了。
跟前两年想的不一样的逻辑是,模型市场未必只会留下一个赢家。 有人供应大量 Token,有人专门解决难题,中间还有一层生意,帮应用把每一次调用分配到合适的模型上。
每个生态位都整整齐齐了。