精选归档 · 第 4 页

6180 条 · 共 91

4月24日4月24日周五

星期五 · 1 条
08:00
Hugging Face:Blog(RSS)精选
AI 评分 78/100
DeepSeek-V4:智能体可实际使用的百万token上下文

DeepSeek发布新一代模型DeepSeek-V4,其核心突破在于实现了长达百万token的上下文窗口,并确保智能体能够有效利用这一扩展的上下文能力。该模型延续了通过开源与开放科学推动人工智能发展与普及的使命,标志着大模型在长上下文理解和实际应用方面迈出重要一步。

另有 3 家信源报道IT之家(RSS)Hacker News 热门(buzzing.cc 中文翻译)Simon Willison 博客
推荐理由:DeepSeek 把上下文窗口推到百万 token 不稀奇,关键是「agent 能实际用」这六个字。如果实测成立,RAG 的很多工程妥协可以扔掉了,做长文档和复杂 agent 的人该第一时间跑一遍。

2月3日2月3日周二

星期二 · 1 条
23:03
Hugging Face:Blog(RSS)精选
AI 评分 80/100
全球开源AI生态系统的未来:从 DeepSeek 到 AI+

Hugging Face 在其官方博客发布文章,展望了全球开源人工智能生态系统的发展路径与未来趋势。文章以 DeepSeek 等代表性开源模型为例,探讨了开源社区如何推动技术民主化与创新加速。核心观点指向一个更加开放、协作的“AI+”未来生态,其中开源框架、模型和工具将深度融入各行各业,降低开发门槛并促进多样化应用场景的涌现。


推荐理由:开源AI核心平台对生态走向的判断,直接影响开发者技术选型和投资方向

1月27日1月27日周二

星期二 · 1 条
23:01
Hugging Face:Blog(RSS)精选
AI 评分 83/100
中国开源AI生态中的架构选择:构建超越DeepSeek的未来

Hugging Face发布博客文章,探讨中国开源人工智能生态系统的核心架构选择与发展路径。文章聚焦于如何构建一个超越现有模型(如DeepSeek)的可持续技术体系,分析了中国开发者在模型架构、训练框架、部署工具和社区协作等方面的关键决策。文中指出,中国开源社区正致力于打造独立且互操作的技术栈,以应对大规模模型训练与推理的独特挑战,并推动全球AI生态的多元化发展。


推荐理由:揭示中国开源AI架构演进,帮助开发者把握生态趋势与选型方向。

12月1日12月1日周一

星期一 · 3 条
18:52
18:52
公众号:DeepSeek(深度求索)精选
AI 评分 66/100
DeepSeek V3.2 正式版:强化 Agent 能力,融入思考推理

DeepSeek 发布正式版 V3.2 与长思考增强版 V3.2-Speciale。V3.2 在推理 Benchmark 中达到 GPT-5 水平,并成为首个支持思考与非思考模式工具调用的模型。


推荐理由:半年前的这版更新,把 Agent 和思考推理揉进了开源模型,回头看算是 DeepSeek 在智能体能力上的关键一刀,做 Agent 开发的至今绕不开它。
00:00
DeepSeek:API 更新日志精选
AI 评分 85/100
DeepSeek-V3.2 及 DeepSeek-V3.2-Speciale 发布

DeepSeek 将 deepseek-chat 和 deepseek-reasoner 均升级为 DeepSeek-V3.2,分别对应非思考模式与思考模式。同时非正式部署 DeepSeek-V3.2-Speciale 的 API 服务,价格不变,仅支持思考模式对话,不支持工具调用,最大输出长度默认 128K,服务截止至北京时间 2025-12-15 23:59。


推荐理由:我觉得DeepSeek V3.2的亮点不是参数,而是思考模式正式接入主力API,意味着推理能力常态化,Speciale那个128K输出更像压力测试,做长文档的可以抓住窗口期探上限。

9月29日9月29日周一

星期一 · 1 条
18:07
公众号:DeepSeek(深度求索)精选
AI 评分 79/100
DeepSeek-V3.2-Exp 发布,引入稀疏注意力提升长文本效率,API 降价超 50%

DeepSeek 发布实验性模型 DeepSeek-V3.2-Exp,在 V3.1-Terminus 基础上引入 DeepSeek Sparse Attention(DSA)稀疏注意力机制,在几乎不影响输出效果的前提下大幅提升长文本训练和推理效率,公开评测表现与 V3.1-Terminus 基本持平。


推荐理由:稀疏注意力在几乎不影响效果的前提下大幅降低长文本成本,API 降价 50% 让依赖长上下文的应用获得了更现实的部署条件。

9月22日9月22日周一

星期一 · 1 条
21:15
公众号:DeepSeek(深度求索)精选
AI 评分 60/100
DeepSeek-V3.1 更新至 Terminus 版本,优化语言一致性与 Agent 能力

DeepSeek-V3.1 已更新至 DeepSeek-V3.1-Terminus 版本,在保持原有能力基础上,缓解了中英文混杂、偶发异常字符等问题,并优化了 Code Agent 与 Search Agent 的表现。官方 App、网页端、小程序与 DeepSeek API 均已同步更新,开源版本已发布至 Hugging Face。


推荐理由:V3.1-Terminus 重点改进了语言混杂和 Agent 表现,开源权重与 API 已同步,适合评估多语言应用和工具调用的稳定性提升。

8月21日8月21日周四

星期四 · 3 条
14:25
公众号:DeepSeek(深度求索)精选
AI 评分 80/100
DeepSeek-V3.1 发布,迈向 Agent 时代的第一步

DeepSeek 正式发布 DeepSeek-V3.1,采用混合推理架构,一个模型同时支持思考与非思考模式,官方 App、网页端及 API 均已同步升级。


推荐理由:混合推理架构统一思考与非思考模式,Agent基准提升具体,API兼容Anthropic格式直接降低Claude Code接入门槛。
14:25
公众号:DeepSeek(深度求索)精选
AI 评分 63/100
DeepSeek-V3.1 发布,迈向 Agent 时代的第一步

DeepSeek-V3.1 以混合推理模型形式开源,用户可一键切换思考模式,同时 Agent 智能体支持性能得到增强。


推荐理由:DeepSeek V3.1 不是小修小补,混合推理和 Agent 支持让它从‘对话模型’转向‘行动模型’,开源这一步让 Agent 开发有了新底座。
00:00
DeepSeek:API 更新日志精选
AI 评分 71/100
DeepSeek-V3.1 发布,升级 chat 与 reasoner 双模式

DeepSeek-V3.1 正式发布,deepseek-chat 与 deepseek-reasoner 分别对应其非思考与思考模式。新模型采用混合推理架构,思考效率较 DeepSeek-R1-0528 更高,并通过 Post-Training 优化提升工具使用与智能体任务表现。


推荐理由:DeepSeek 把推理和非思考模式合并到一个模型,解决了之前切模型的体验割裂,Agent 能力提升对做工具调用的开发者是直接利好。

5月29日5月29日周四

星期四 · 2 条
20:07
公众号:DeepSeek(深度求索)精选
AI 评分 85/100
DeepSeek-R1 更新至 0528 版本,推理能力显著增强

DeepSeek 发布 R1 模型小版本升级 DeepSeek-R1-0528,在数学、编程与通用逻辑等基准测评中取得当前国内所有模型中首屈一指的成绩,整体表现接近 o3 与 Gemini-2.5-Pro。


推荐理由:后训练投入增加带来的推理提升幅度,为开源社区提供了可蒸馏的高质量思维链,小模型也能接近大模型表现。

5月28日5月28日周三

星期三 · 1 条
00:00
DeepSeek:API 更新日志精选
AI 评分 71/100
DeepSeek 将 deepseek-reasoner 升级为 DeepSeek-R1-0528

DeepSeek 将 deepseek-reasoner 模型升级为 DeepSeek-R1-0528,推理能力显著增强,AIME 2025 得分从 70.0 升至 87.5,GPQA 从 71.5 升至 81.0。新版本优化了 Web 前端开发能力,并极大抑制了老版本 R1 的幻觉问题,同时支持 Json Output 与 Function Calling。


推荐理由:DeepSeek 把 R1 的推理能力又拉高了一大截,AIME 涨 17 分、Aider 涨 14 分,JSON Output 和 Function Calling 的加入让它在 agent 场景里更实用了,做复杂推理产品的人应该第一时间切过去试试。

3月25日3月25日周二

星期二 · 2 条
21:24
公众号:DeepSeek(深度求索)精选
AI 评分 74/100
DeepSeek-V3-0324 发布:推理、代码与中文写作能力全面升级

DeepSeek 发布小版本升级 DeepSeek-V3-0324,在数学、代码类评测集上得分超过 GPT-4.5,并增强了前端代码生成、中文写作与联网搜索能力。模型参数约 660B,开源版本上下文长度为 128K,网页端、App 和 API 提供 64K 上下文。权重已开源,采用 MIT License,允许蒸馏训练其他模型。


推荐理由:推理能力提升至超越 GPT-4.5 的同时保持 MIT 开源许可,让低成本部署强推理模型的门槛进一步降低。
21:23
公众号:DeepSeek(深度求索)精选
AI 评分 64/100
DeepSeek-V3 模型更新,各项能力全面进阶

DeepSeek-V3 新版已发布,关闭深度思考模式即可体验,模型权重同步开源。

另有 1 家信源报道公众号:DeepSeek(深度求索)
推荐理由:DeepSeek-V3 发布时是开源模型的有力竞争者,但这条一年多前的旧闻如今毫无新意,对关注 AI 动态的你来说,可以直接跳过。

3月24日3月24日周一

星期一 · 1 条
00:00
DeepSeek:API 更新日志精选
AI 评分 72/100
DeepSeek 将 deepseek-chat 升级为 DeepSeek-V3-0324

DeepSeek 将 deepseek-chat 模型升级为 DeepSeek-V3-0324,推理能力增强,MMLU-Pro 升至 81.2,AIME 升至 59.4。同时优化了 Web 前端开发、中文写作(对齐 R1 风格)、中文搜索及 Function Calling 准确率,并修复了此前问题。


推荐理由:这是 DeepSeek V3 发布后的一次重要版本更新,推理和代码能力提升显著,AIME 提升近 20 分,前端和中文写作体验优化,API 用户应该尽快切换。

1月29日1月29日周三

星期三 · 1 条
00:00

1月20日1月20日周一

星期一 · 1 条
20:10
公众号:DeepSeek(深度求索)精选
AI 评分 64/100
DeepSeek-R1 发布,性能对标 OpenAI o1 正式版

DeepSeek-R1 发布,性能对标 OpenAI o1 正式版。模型遵循 MIT License 开放 API,训练技术同步公开。


推荐理由:虽已是旧闻,但 DeepSeek-R1 作为首个开源对齐 o1 的模型,其训练技术至今仍有参考价值,做推理方向的值得回溯。