精选归档 · 第 34 页

661676 条 · 共 676

5月22日5月22日周四

星期四 · 1 条
00:00

5月11日5月11日周日

星期日 · 1 条
00:00
Prime Intellect(网页)精选
AI 评分 66/100
Prime Intellect 发布 INTELLECT-2,32B 推理模型通过全球分布式强化学习训练

Prime Intellect 发布 INTELLECT-2,称其为首个通过全球分布式强化学习训练的 32B 参数推理模型,并在数学和编码基准上超过 QwQ-32B。


推荐理由:原文给出分布式异步 RL 的完整基础设施与训练配方细节,并开源模型、代码和数据,读者可以了解去中心化训练的可行路径。

5月5日5月5日周一

星期一 · 1 条
00:00
Cognition 模型 / Devin 博客(网页)精选
AI 评分 74/100
Cognition 发布 DeepWiki,为任意 GitHub 仓库生成免费 AI 文档

Cognition 推出 DeepWiki,将 Devin Wiki 和 Devin Search 免费公开,把 URL 中的 github.com 换成 deepwiki.com 即可查看任意仓库的 AI 文档。已索引超过 50,000 个热门公开仓库,涵盖 Model Context Protocol、LangChain 等;公开仓库可免费添加,私有仓库需 Devin 账号。


推荐理由:原文给出了使用方式和已索引规模,读者可以据此判断如何用 DeepWiki 快速理解陌生代码仓库。

4月15日4月15日周二

星期二 · 1 条
00:00

3月25日3月25日周二

星期二 · 2 条
21:24
公众号:DeepSeek(深度求索)精选
AI 评分 74/100
DeepSeek-V3-0324 发布:推理、代码与中文写作能力全面升级

DeepSeek 发布小版本升级 DeepSeek-V3-0324,在数学、代码类评测集上得分超过 GPT-4.5,并增强了前端代码生成、中文写作与联网搜索能力。模型参数约 660B,开源版本上下文长度为 128K,网页端、App 和 API 提供 64K 上下文。权重已开源,采用 MIT License,允许蒸馏训练其他模型。


推荐理由:推理能力提升至超越 GPT-4.5 的同时保持 MIT 开源许可,让低成本部署强推理模型的门槛进一步降低。
21:23

2月10日2月10日周一

星期一 · 1 条
08:00
Zyphra Research(网页)精选
AI 评分 71/100
Zyphra 发布 Zonos-v0.1 beta 开源 TTS 模型

Zyphra 以 Apache 2.0 许可发布 Zonos-v0.1 beta,包含 1.6B transformer 与 1.6B SSM hybrid 两个实时 TTS 模型,后者是首个开源 TTS SSM 模型。


推荐理由:官方发布了模型权重、API 定价和架构细节,读者可以据此评估开源 TTS 与专有模型的差距与可用性。

1月29日1月29日周三

星期三 · 1 条
00:00

12月26日12月26日周四

星期四 · 1 条
19:17
公众号:DeepSeek(深度求索)精选
AI 评分 67/100
DeepSeek-V3 正式发布

深度求索正式发布 DeepSeek-V3 模型,性能比肩世界顶尖模型,速度跃升,价格更新。


推荐理由:DeepSeek-V3 是 2024 年底国产模型的一次真正跃迁,首次亮剑就逼近闭源顶尖,开源权重更是直接改变了开发者生态。时隔一年半回头看,它仍是理解 DeepSeek 路径的起点。

12月6日12月6日周五

星期五 · 1 条
00:00
ARC Prize:官方博客精选
AI 评分 64/100
ARC Prize 2024 获奖名单与技术报告发布

ARC Prize 官方公布 2024 年获奖者并发布技术报告,共 1,430 支队伍提交 17,789 个方案,ARC-AGI-1 SOTA 从 33% 升至 55.5%,但 100 万美元大奖无人认领。


推荐理由:官方技术报告给出完整获奖方案与三类新方法总结,读者可以据此了解 ARC-AGI 分数提升背后的具体技术路线。

11月29日11月29日周五

星期五 · 1 条
00:00
Prime Intellect(网页)精选
AI 评分 66/100
Prime Intellect 发布 INTELLECT-1:首个全球分布式训练的 10B 参数模型

Prime Intellect 发布 INTELLECT-1,称其为首个全球协作训练的 10B 参数语言模型,基于 Llama-3 架构在 1T token 上训练 42 天,跨五国三洲最多同时使用 112 张 H100。


推荐理由:原文给出分布式训练的关键数字和 PRIME 框架细节,读者可以了解跨洲协作训练 10B 模型的可行性与工程代价。

10月28日10月28日周一

星期一 · 1 条
00:00
ARC Prize:官方博客精选
AI 评分 60/100
Mike Knoop 与 François Chollet 阐述结合深度学习与程序合成攻克 ARC-AGI 的技术路径

ARC Prize 团队于 2024 年 10 月 24 日举办线上活动,说明为何单靠深度学习难以攻克 ARC-AGI,并提出结合深度学习与程序合成的技术路线。


推荐理由:Chollet 和 Knoop 系统论述 LLM 局限于记忆技能、需结合程序合成才能胜出 ARC-AGI 的技术路径,为理解智能与抽象层次提供了可迁移的分析框架。

9月6日9月6日周五

星期五 · 1 条
19:38

6月11日6月11日周二

星期二 · 1 条
00:00
ARC Prize:官方博客精选
AI 评分 65/100
ARC Prize 发布:百万美元奖金挑战 ARC-AGI 基准

ARC Prize 官方宣布启动一项总奖池超过 $1,000,000 的竞赛,目标是击败 ARC-AGI 评测并开源解决方案,由 Mike Knoop 和 François Chollet 主办。ARC-AGI 于 2019 年推出,当前 SOTA 仅约 34%,对人类容易但现代 AI 极难。官方认为 LLM 依赖记忆而非真正推理,希望通过激励开源研究提升新想法的产生速度。


推荐理由:官方说明了设奖动机和 ARC-AGI 为何未被刷分,读者可以了解百万美元奖金背后的开源 AGI 主张。

4月16日4月16日周二

星期二 · 1 条
08:00