DeepSeek V4.1 Flash 发布,以 40 分超越 DeepSeek V4 Pro 0813 成为新旗舰

Artificial Analysis · @ArtificialAnlys · X·2026-09-11 04:36·1小时前
AI 导读

Artificial Analysis 评测显示,DeepSeek V4.1 Flash 在 Intelligence Index 得分 40,超过 DeepSeek V4 Pro 0813 成为 DeepSeek 新旗舰,输入激活参数 8B、输出激活参数 16B,支持 1M token 上下文,MIT 许可。

Artificial Analysis@ArtificialAnlys
同事件
77AI 编辑部评分,满分 100

DeepSeek V4.1 Flash 发布,以 40 分超越 DeepSeek V4 Pro 0813 成为新旗舰

2026-09-11 04:36· 1小时前
AI 导读

Artificial Analysis 评测显示,DeepSeek V4.1 Flash 在 Intelligence Index 得分 40,超过 DeepSeek V4 Pro 0813 成为 DeepSeek 新旗舰,输入激活参数 8B、输出激活参数 16B,支持 1M token 上下文,MIT 许可。

正文 · AI 翻译

DeepSeek V4.1 Flash 超越 DeepSeek V4 Pro 0813,成为 DeepSeek 新的旗舰模型,在 Artificial Analysis Intelligence Index 上得分 40。它仅有 552B 参数,却超越了 Pro(1.6T)模型,同时每 token 成本约为其 1/4,因其冗长而略低于智能与成本帕累托前沿

@deepseek_ai 发布了 DeepSeek V4.1 Flash,是 DeepSeek V4 Flash 0731 的继任者。这是一个 552B 模型,采用全新的因果 Encoder-Decoder 架构,使其输入仅需 8B 激活参数,输出仅需 16B 激活参数。

在官方 API 上,DeepSeek V4.1 Flash 定价为每 1M 输入 token 0.30 美元、每 1M 输出 token 1.20 美元,缓存输入 token 定价仅为每 1M token 0.006 美元,折扣达 98%。非高峰时段定价在输入、缓存输入和输出 token 上再提供 50% 折扣。V4.1 Flash 比 DeepSeek V4 Flash 0731 便宜约 20%,比 DeepSeek V4 Pro 0813 便宜约 4 倍,同时性能更高。

关键结果:

➤ DeepSeek V4.1 Flash 在智能体能力和长上下文推理方面取得提升。DeepSeek V4.1 Flash 在 Terminal-Bench v4.0 中得分 27%,是 DeepSeek V4.0 Flash 的 27% 的两倍多。其 GDPval-AA v2 上升 164 Elo 分,从 1468 升至 1632,使 V4.1 Flash 领先于 Kimi K3(1584)。DeepSeek V4.1 Flash 在 AA-LCR v1.1 上还得分 84%,与 GPT-5.6 Sol(84%)和 Gemini 3.8 Flash(84%)处于同一水平。凭借 1M token 上下文窗口,这使其成为以 flash 级定价处理长文档和大型代码库工作的强力选择。

➤ DeepSeek V4.1 Flash 以 69% 的成绩在 AutomationBench-AA 上位列第一,与 GPT-6 Astra(69%)持平,略高于 Grok 4.6(67%)。AutomationBench-AA 衡量的是跨 657 项任务的智能体工作流,覆盖 39 个 SaaS 应用,包括 Salesforce、Jira、Gmail、Zendesk 和 Google Sheets,评分标准是模型能否在不触发护栏的情况下完成目标。DeepSeek V4.1 Flash 相比 DeepSeek V4 Flash 0731(54%)提升了 15 个百分点,比 DeepSeek V4 Pro 0813(57%)高 12 个百分点,比 GLM-5.3(62%)高 7 个百分点。

➤ DeepSeek V4.1 Flash 是我们测过的输出最冗长的模型之一,在 Intelligence Index 每项任务上平均消耗 89k Tokens。这比 Z AI 的旗舰模型 GLM-5.3(71k)多 25%,比 GLM-5.3-Flash(69k)多 29%,比 DeepSeek V4 Pro 0813(55k)多 62%。它的输出 token 用量甚至超过前沿模型,包括 Fable 5.1(78k)和 Claude Opus 5(73k)。

➤ 尽管如此冗长,DeepSeek V4.1 Flash 在 Intelligence Index 每项任务上的成本仍仅为 $0.27。这主要得益于其低价:每 1M 输入 tokens 收费 $0.30,每 1M 输出 tokens 收费 $1.20,缓存输入 tokens 每 1M 仅 $0.006,折扣达 98%。这比 GLM-5.3($2.01)和 Kimi K3($2.00)低约 7 倍,比 DeepSeek V4 Pro 0813($0.67)低约 2.5 倍。

模型其他细节:

➤ 上下文窗口:1M tokens

➤ 定价:在 DeepSeek 一方 API 上,每 1M 输入/输出 tokens 收费 $0.30 / $1.20,缓存命中折扣 98%(每 1M 缓存输入 tokens $0.006)

➤ 输入模态:文本和图像

➤ 规模:总参数量 763B,输入激活参数量 8B,输出激活参数量 16B

➤ 许可证:MIT

➤ 提供方:DeepSeek 第一方 API