跳到正文
xAI:News·· 2025-09-19精选AI 评分82

xAI 发布 Grok 4 Fast:2M token 上下文,同等性能价格降 98%

Grok 4 Fast Pushing the Frontier of Cost-Efficient Intelligence Sep 19, 2025

AI 导读

xAI 发布 Grok 4 Fast,主打高性价比推理,实现与 Grok 4 相当的基准表现,同时平均少用 40% 思考 token,达到同等前沿基准性能的价格降低 98%。

推荐理由

官方给出了与 Grok 4 等模型的基准对比、token 效率提升和 API 定价,读者可据此评估其成本与性能取舍。

正文 · AI 翻译

Abstract digital hummingbird

我们非常激动地推出 Grok 4 Fast,这是我们在高性价比推理模型方面的最新进展。基于 xAI 从 Grok 4 中获得的经验,Grok 4 Fast 在企业级和消费级领域均实现了前沿水平的性能——并具有卓越的 token 效率。该模型突破了更小、更快 AI 的边界,让更多用户和开发者能够获得高质量推理。Grok 4 Fast 具备最先进的(SOTA)成本效益、前沿的网页和 X 搜索能力、200 万 token 上下文窗口,以及将 reasoning 和 non-reasoning 模式融合于单一模型的统一架构。

推进高性价比智能

Grok 4 Fast 在高性价比智能方面树立了新的前沿,在推理基准上超越 Grok 3 Mini,同时大幅削减 token 成本。

基准 pass@1Grok 4 FastGrok 4Grok 3 Mini (High)GPT-5 (High)GPT-5 Mini (High)

GPQA Diamond

85.7%87.5%79.0%85.7%82.3%

AIME 2025(无工具)

92.0%91.7%83.0%94.6%91.1%

HMMT 2025(无工具)

93.3%90.0%74.0%93.3%87.8%

HLE(无工具)

20.0%25.4%11.0%24.8%16.7%

LiveCodeBench(1 月至 5 月)

80.0%79.0%70.0%86.8%77.4%

我们使用大规模强化学习来最大化 Grok 4 Fast 的智能密度。在我们的评估中,Grok 4 Fast 在基准上达到与 Grok 4 相当的性能,同时平均少用 40% 的思考 token。

Grok 4 Fast 的 token 效率提升 40%,再加上显著更低的每 token 价格,使得在前沿基准上达到与 Grok 4 相同性能的价格降低了 98%。根据 Artificial Analysis 的独立评审验证,与 Artificial Analysis Intelligence Index 上其他公开可用的模型相比,Grok 4 Fast 展现出最先进的(SOTA)价格智能比。

*所有 Claude 模型均使用 Extended Thinking 进行基准测试。

原生工具使用与 SOTA 搜索

Grok 4 Fast 通过工具使用强化学习(RL)进行端到端训练。它擅长判断何时调用代码执行或网页浏览等工具。

例如,Grok 4 Fast 展现出前沿的智能体搜索能力,无缝浏览网页和 X,以实时数据增强查询。它跳转链接、摄取媒体(包括 X 上的图片和视频),并以光速综合发现。

基准 pass@1Grok 4 FastGrok 4Grok 3(无推理)

BrowseComp

44.9%43.0%—

SimpleQA

95.0%94.0%82.0%

Reka Research Eval

66.0%58.0%37.0%

BrowseComp (zh)

51.2%45.0%10.8%

X Bench Deepsearch (zh)

74.0%66.0%27.0%

X Browse*

58.0%53.2%20.8%

*X Browse 是一个内部基准,用于评估智能体在 X 上的多跳搜索和浏览能力。

通用后训练的前沿

Grok 4 Fast 还在通用领域建立了新的高性价比前沿。我们很高兴分享 Grok 4 Fast 在 LMArena 上的结果,它一直在 Search 和 Text Arena 上私下进行实战测试。

在 LMArena 的 Search Arena 中,grok-4-fast-search(代号:menlo)以 1163 Elo 位居 #1——以 17 的显著优势领先 o3-search。其卓越的推理效率和智能密度使其在真实世界的搜索相关任务上超越大得多的模型。

Artificial Intelligence Search Arena

在 LMArena 的 Text Arena 中,grok-4-fast(代号:tahoe)排名 #8,表现与 grok-4-0709 相当,凸显了其非凡的智能密度。值得注意的是,它在同量级中显著优于同类,所有可比规模的模型均排名 第 18 位 或更低。

Artificial Intelligence Text Arena

以下是 Grok 4 Fast 实际运行的一些示例:

Path of Exile 2 中可能获得的最大经验值是多少?

统一模型:推理与非推理

此前,不同的推理模式需要不同的模型。Grok 4 Fast 引入了统一架构,其中 reasoning(长思维链)和 non-reasoning(快速响应)由相同的模型权重处理,并通过系统提示进行引导。这种统一降低了端到端延迟以及 token 成本,使 Grok 4 Fast 成为实时应用的理想选择。

在 grok.com 中,这带来了流畅的过渡:对简单查询即时响应,或对复杂查询进行扩展推理。在 xAI API 中,开发者可以微调此行为,针对速度或深度进行优化。

Grok 4 Fast 现已面向所有用户开放。在 Fast 和 Auto 模式下,您将在搜索和信息查询方面看到显著改进。此外,Auto 模式下的困难查询将使用 Grok 4 Fast,这将提供更快的体验而不损失质量。这是首次所有用户,包括免费用户,都能不受限制地访问我们的最新模型,标志着迈向先进 AI 民主化的一步。

OpenRouter、Vercel AI Gateway 和 xAI API 上的 Grok 4 Fast

我们将 Grok 4 Fast 作为两个模型推出:grok-4-fast-reasoning 和 grok-4-fast-non-reasoning,每个都具有 2M token 的上下文窗口。这允许开发者调整应用于其用例的测试时计算量。

grok-4-fast-reasoning 和 grok-4-fast-non-reasoning 已通过 xAI API 正式可用,定价如下:

Token 类型<128k tokens≥128k tokens
输入 tokens$0.20 / 1M$0.40 / 1M
输出 tokens$0.50 / 1M$1.00 / 1M
缓存输入 tokens$0.05 / 1M

下一步

我们将根据您在 x.com 上的反馈,持续为 Grok 4 Fast 发布模型改进。敬请期待更多集成,包括增强的多模态能力和智能体功能。

在此处阅读 Grok 4 Fast 模型卡。

目前就这些——再见,感谢所有的鱼!

来源:xAI:News · x.ai