Topic · 主题全部主题 →

AI 编码

AI 写代码的一切:编码助手、Vibe Coding、代码模型评测与开发工作流变革。

5,065条收录
583条精选

精选归档 · 第 19 页

361380 条 · 共 583

5月15日5月15日周五

星期五 · 11 条
10:48
HuggingFace Daily Papers(社区热门论文)精选
AI 评分 72/100
Orchard:一个开源智能体建模框架

针对智能体建模领域因依赖闭源资源而受限的问题,研究团队推出了开源框架Orchard。其核心是轻量级环境服务Orchard Env,提供跨任务和流程的可复用沙箱管理基元。基于此构建了三个高效智能体方案:编码智能体Orchard-SWE在SWE-bench Verified上达到67.5%的准确率;视觉语言计算机使用智能体Orchard-GUI仅用少量数据便在多项基准测试中取得64.0%-74.1%的成功率;个人助理智能体Orchard-Claw仅用0.2K合成任务便在Claw-Eval上实现59.6%的pass@3成功率。该框架证明了其跨领域实现可复用数据、训练与评估的能力。


推荐理由:开源终于能打低数据量、高性能的 agent recipe 了,Orchard-SWE 在 SWE-bench 拿下 67.5%,只用了 107K 条蒸馏轨迹,小团队也能复现,做 coding agent 的必读。
06:56
Claude Code:GitHub Releases(RSS)精选
AI 评分 63/100
Claude 代理工具 v2.1.142 版本更新

Claude 代理工具发布 v2.1.142 版本。本次更新新增了 --add-dir--settings--model 等 8 个用于配置后台会话的命令行标志,并将 Fast 模式的默认模型升级为 Opus 4.7。插件功能得到增强,拥有根目录 SKILL.md 的插件现可被识别为技能,插件详情面板会显示其提供的 LSP 服务器。此外,版本修复了超过 15 项问题,包括 MCP 工具超时设置失效、后台会话在系统休眠后异常断开、守护进程升级后无法正常退出、Windows 网络驱动器工作目录下死锁等关键错误,并改进了响应式压缩和钩子配置错误提示。


推荐理由:Claude Code 把 Agent 配置折腾得更顺手了,后台任务死锁、睡眠唤醒崩掉这类老毛病也修了一串,如果你的 Dispatch Agent 经常掉链子,这次升级很实在。
05:18
04:09
OpenAI:官网动态(RSS · 排除企业/客户案例)精选
AI 评分 78/100
随时随地使用 Codex

用户现可通过 ChatGPT 移动应用随时随地使用 Codex。该功能支持跨设备和远程环境实时监控、引导及批准编码任务,实现了对编程工作的无缝移动端管理。


推荐理由:Codex mobile让你在手机上监控和指挥AI写代码,对需要远程协作的开发者是个实用升级,不过更像功能补全而非颠覆性创新,适合日常需要随时掌控进度的团队。
03:01
xAI:News(网页)精选
AI 评分 73/100
xAI 推出 Grok Build 早期测试版

xAI 面向 SuperGrok Heavy 订阅用户推出 Grok Build 早期测试版。这是一个直接在终端运行的新型编程智能体与命令行工具,专为专业软件工程和复杂任务设计。其核心功能包括:支持“计划模式”,允许用户在代码执行前审阅和修改详细步骤;能无缝集成现有开发工具链;可将大型任务分解,交由并行运行的专用子智能体处理。此外,该工具提供无头模式,便于脚本和自动化流程集成。用户可通过单行命令安装并立即在项目中使用。


推荐理由:xAI终于下场做终端里的编码代理了,功能规划看着挺全,但早期beta只开放给SuperGrok Heavy用户,普通开发者还得再等等。
02:00
Claude:Blog(网页)精选
AI 评分 74/100
创始人手册:构建AI原生初创公司

Anthropic公司发布了一份面向AI原生初创企业的实用指南,旨在重塑2026年创业生命周期的构思、最小可行产品、发布和规模化四个核心阶段。该手册为每个阶段提供了具体目标、退出标准、常见失败模式及AI驱动练习,涵盖如何利用Claude进行问题验证与客户发现、避免AI生成代码的技术债务、区分真实产品市场契合度与早期炒作,并引入智能工作流替代创始人手动操作。指南还整合了多家初创企业的实践案例,为从零开始围绕AI构建公司的创始人提供架构、范围与安全方面的最佳实践。


推荐理由:这份创业手册把从Idea到Scale四阶段拆成了可复制的流程和prompt,不再是玄学方法论,而是创始人可以直接上手操作的“AI创业作弊本”。
00:38
🚨 AI News | TestingCatalog@testingcatalog精选
AI 评分 76/100
Kimi发布支持多款AI编程助手的浏览器扩展Kimi released Kimi Web Bridge, a new browser extension that works with various agents, including Claude Code, Hermes, Codex, Kimi Code CLI, and more.One Browser Use for all 👀Kimi发布了Kimi Web Bridge,这是一款可与多种代理协同工作的新浏览器扩展,包括Claude Code、Hermes、Codex、Kimi Code CLI等。 一浏览器通用于所有 👀 试用地址:http://kimi.com/features/webbridge 及Chrome网上应用店。

Kimi.ai: Supports Kimi Code CLI, Claude Code, Cursor, Codex, Hermes, and more. Try it at: http://kimi.com/features/webbridge and ...


推荐理由:Kimi这个浏览器扩展把Claude Code、Cursor等各路Agent的网页交互统一了,如果真能无缝衔接,做开发的和做自动化的人可以省下大把调试时间。

5月14日5月14日周四

星期四 · 4 条
21:29
Hacker News 热门(buzzing.cc 中文翻译)精选
AI 评分 78/100
克劳德代码与《代码书》技能:有针对性的技能培养

开发者发布了一款名为“克劳德代码与《代码书》技能”的GitHub工具,旨在通过刻意练习提升编程技能。该工具利用AI模型生成特定主题的代码示例与解释,帮助用户进行针对性学习。项目在Hacker News上获得104点热度,关注度较高。其核心变化在于将传统的广泛学习转化为聚焦、可重复的技能训练模式,通过结构化练习提升学习效率。


推荐理由:这个skill把Claude Code变成一对一的代码教练,专门抓你代码里的坏习惯,对想用AI真正提升编码水平的人是个好东西。
13:58
Xiaomi MiMo@XiaomiMiMo精选
AI 评分 69/100
MiMo V2.5 Pro 获设计竞技场季军MiMo V2.5 Pro just placed 3rd on @DesignArena! 🎉MiMo V2.5 Pro 在 @DesignArena 上刚刚获得第三名!🎉 MiMo V2.5 Pro (Thinking) 在总排行榜上比 MiMo-V2.5 提升了 8 个名次,在前端编码任务中达到与 Claude Sonnet 4.6 相同的性能水平。 衷心祝贺 @XiaomiMiMo 团队取得这些进步!

Design Arena: BREAKING: MiMo V2.5 Pro (Thinking) takes 3rd overall out of open weights models on Design Arena. MiMo V2.5 Pro (Thinking...


推荐理由:小米MiMo在Design Arena前端编码评测里直接杀进前三,跟Claude Sonnet 4.6平起平坐,这是国产开源模型在代码能力上第一次给我真正的压迫感,搞前端的可以盯一下。
07:55
Claude Code:GitHub Releases(RSS)精选
AI 评分 67/100
Claude 工具 v2.1.141 版本更新

Claude 工具发布 v2.1.141 版本,带来多项功能新增与优化。主要更新包括:为钩子输出添加 terminalSequence 字段以支持无控制终端的桌面通知;新增 CLAUDE_CODE_PLUGIN_PREFER_HTTPS 环境变量,便于通过 HTTPS 克隆插件源码;引入 ANTHROPIC_WORKSPACE_ID 变量以在多工作区联盟中限定令牌范围。会话管理方面,claude agents 命令新增 --cwd 参数用于按目录筛选,并优化后台代理的状态归类。用户体验改进包括:在倒带菜单添加“总结至此”选项以压缩早期上下文;长思考超时后旋转指示器变色提供更明确反馈;此外,还修复了 Markdown 表格渲染异常、权限提示逻辑、历史记录管理等超过 30 项问题。


推荐理由:Claude Code 的小版本但修得扎实,MCP 连接、/bg 权限继承、VSCode 语音等一堆边角都补了,Agent 模式稳定性明显提升,强烈建议升级。

5月13日5月13日周三

星期三 · 4 条
11:55
Tencent Hy@TencentHunyuan精选
AI 评分 76/100
Hy3预览版登陆GMI,开源最强模型领跑Hy3 preview is now on @gmi_cloud. 🙌Hy3 预览版现已登陆 @gmi_cloud。🙌

GMI Cloud: Hy3 preview from @TencentHunyuan is now live on GMI #1 on OpenRouter's LLM leaderboard, open-sourced, and the strongest ...


推荐理由:腾讯混元 Hy3 开源且登顶 OpenRouter 排行榜,295B MoE 架构在推理和代码上提升明显,不是小厂的刷榜产品,搞 agent 和 coding 的可以认真试试。
08:00
ClaudeDevs@ClaudeDevs精选
AI 评分 69/100
Claude Code新增/goal功能确保任务完成How do you keep Claude working until the job is done? Claude Code helps with this in a few ways, including one we shipped recently: /goal.如何让Claude持续工作直至任务完成?Claude Code通过几种方式提供帮助,包括我们最近推出的功能:/goal。

推荐理由:Claude Code 的 /goal 命令解决了一个长期痛点,让 AI 能自己持续拆解执行复杂任务,不用开发者反复盯着推送,做长任务自动化的人可以直接试。