# DeepSeek V4.1 Flash 模型上线国家超算互联网

- 来源：IT之家（RSS）
- 发布时间：2026-09-10 19:47
- AIHOT 分数：58
- AIHOT 链接：https://aihot.news/items/cmtvh5y7805wtronbq9u7fqbo
- 原文链接：https://www.ithome.com/1/000/976.htm

## AI 摘要

DeepSeek V4.1 Flash 模型 9 月 10 日上线国家超算互联网中心，用户可在官网「模型服务」页面调用其 API。该模型为 552B 参数 MoE 模型，采用 Causal-Encoder-Decoder 结构，输入激活 8B、输出激活 16B；基准测试中超越了包括 DeepSeek V4 Pro 在内的旗舰模型。

## 正文

IT之家 9 月 10 日消息，DeepSeek V4.1 Flash 模型今日上线国家超算互联网中心。用户可登录国家超算互联网官网，从首页进入「模型服务」页面，即可快速打开 DeepSeek V4.1 Flash 模型 API 调用界面。

据IT之家了解，DeepSeek V4.1 Flash 为 552B 参数的 MoE 模型，采用了全新的 Causal-Encoder-Decoder 结构，输入和输出不对称，输入激活只有 8B，输出激活 16B，成本显著低于已知的同尺寸模型。

同时，V4.1 Flash 还采用了新的预训练方式、经过了更大规模的强化学习后训练，在基准测试中，成功超越了包括 DeepSeek V4 Pro 在内的一众旗舰模型的智能水平。

此外，DeepSeek V4.1 Flash 大幅减少了 KV Cache 缓存的大小，与上一代模型相比，对 HBM 的需求减少到 1/4，对 SSD 的需求减少到 1/8。在 Agent 使用场景中，缓存命中的费用往往占比较高，对 KV Cache 的压缩大幅降低了 Agent 类任务的使用成本。
