DeepSeek宣布自9月14日起V4-Pro API请求将临时路由至V4.1-Flash,直至V4.1-Pro到来
事件全貌
AI 综述DeepSeek 宣布,自北京时间9月14日起,其 V4-Pro API 的请求将临时路由至 V4.1-Flash 模型,直至 V4.1-Pro 到来。公司宣称 V4.1-Flash 在能力、成本和速度上已超越 V4-Pro。
根据另一份报道,DeepSeek 计划于北京时间9月10日左右推出具有原生多模态支持的 V4.1 Flash。同时,V4 Pro 服务计划于北京时间9月14日中午结束,届时请求将被路由至 V4.1 Flash 并按其费率计费,这被视为一次后端迁移。
最新进展显示,DeepSeek 开源了一些新的代码仓库,旨在简化 V4.1 Flash 及后续开源模型的部署。
AI 汇总报道生成 · 1天前更新。单篇报道保留其发布时的原貌。
DeepSeek 开源了新的代码仓库,以简化 V4.1 Flash 及后续开源模型的部署。
报道时间线
沿着报道,了解事件的不同侧面。
- DeepSeek 开源新仓库助力 V4.1 Flash 部署
DeepSeek 开源了一些新的代码仓库,方便更容易地部署 V4.1 Flash 以及后续的开源模型: https://github.com/deepseek-ai/deepseek-recipe https://github.com/deepseek-ai/DeepSelect https://github.com/deepseek-ai/DeepJIT
- DeepSeek 合并快速、专家、识图模式,计划推出 V4.1 Flash 并下线 V4 Pro
DeepSeek 将快速、专家、识图三种模式合并升级,移除独立的专家模式选项,新模型同时具备日常对话、图片理解与复杂问题解决能力。公司计划在北京时间 9 月 10 日前后推出原生多模态的 V4.1 Flash;V4 Pro 服务定于北京时间 9 月 14 日中午结束,之后请求将被路由到 V4.1 Flash 并按其费率计费。
- DeepSeek 发布 V4.1-Flash:新 Causal Encoder–Decoder 架构,带原生视觉理解
DeepSeek 发布 V4.1-Flash,采用新 Causal Encoder–Decoder 架构并支持原生视觉理解,为其新架构家族中最小模型。该模型为 552B 参数 MoE,输入处理激活 8B、输出生成激活 16B;KV cache 需求较上一代降至 HBM 的 1/4、SSD 存储的 1/8,API 价格更低。
本事件热度走势
移动指针或点击图表查看每小时热度;键盘可用左右方向键切换。