精选归档 · 第 34 页

661680 条 · 共 968

5月13日5月13日周三

星期三 · 11 条
08:00
ClaudeDevs@ClaudeDevs精选
AI 评分 69/100
Claude Code新增/goal功能确保任务完成How do you keep Claude working until the job is done? Claude Code helps with this in a few ways, including one we shipped recently: /goal.如何让Claude持续工作直至任务完成?Claude Code通过几种方式提供帮助,包括我们最近推出的功能:/goal。

推荐理由:Claude Code 的 /goal 命令解决了一个长期痛点,让 AI 能自己持续拆解执行复杂任务,不用开发者反复盯着推送,做长任务自动化的人可以直接试。
07:27
Hacker News:AI 热帖精选
AI 评分 76/100
展示 HN:Statewright--通过可视化状态机提升AI智能体可靠性

Statewright 是一个通过状态机为AI智能体提供约束的系统,能控制其在各阶段可使用的工具,从而聚焦推理并提升可靠性。它将工作流定义为规划、实施、测试等多个阶段,自动执行工具限制与状态转换。在本地模型测试中,两个模型在5项SWE-bench子任务上应用约束后,正确率从2/10显著提升至10/10。该系统已集成到Claude Code等平台,一个修复测试失败的典型工作流可在46秒内完成。


推荐理由:Statewright用状态机给AI代理上“紧箍咒”,让13B小模型也能搞定SWE-bench任务,做coding agent的应该立刻装上试试。
06:38
Demis Hassabis@demishassabis精选
AI 评分 81/100
谷歌AI重塑智能鼠标指针交互Really cool work from the team reimagining the mouse pointer to be intelligent! Try the prototype in @GoogleAIStudio it's pretty magical.团队正在用AI重新构想鼠标指针,成果非常酷!在@GoogleAIStudio尝试原型版本,体验相当神奇。 【引用 @GoogleDeepMind】:我们正用AI重新构想这个存在50年的界面--鼠标指针。🖱️ 这些实验演示展示了人们如何通过动作、语音和自然简写,在屏幕上直观操控Gemini完成任务🧵

Google DeepMind: We’re reimagining a 50-year-old interface - the mouse pointer - with AI. 🖱️ These experimental demos show how people ca...


推荐理由:用了50年的鼠标指针第一次被AI改造,这个原型让你在屏幕上随手画圈、说话、打缩写就能控制Gemini,产品经理和设计师都该去玩一下。
05:53
Claude Code:GitHub Releases(RSS)精选
AI 评分 70/100
v2.1.140 版本更新

本次更新包含多项错误修复与体验优化。核心改进包括:增强了Agent工具的subagent_type匹配逻辑,现对大小写和分隔符不敏感;修复了/goal命令在特定钩子设置下无响应的问题,现会显示明确提示;解决了Windows系统上因缺失可执行文件导致的周期性事件循环停滞。此外,还修正了后台服务启动、远程设置认证重试、托管市场更新策略持久化、/loop命令调度冗余以及Read工具参数验证等多个问题。插件系统现会对因配置冲突而被静默忽略的默认组件文件夹发出警告。


推荐理由:Claude Code 这次修了一批烦人小 bug,尤其是 /goal 不再装死、/loop 不再空转,用着难受的开发者可以立刻更新试试。
04:33
OpenAI Developers@OpenAIDevs精选
AI 评分 70/100
Codex实现跨应用无感多任务处理Computer use lets Codex work across your apps without taking over your Mac.@AriX talks with @romainhuet about what changes when agents can click, type, and keep working in the background.计算机使用让Codex能在你的应用间工作而不占用你的Mac。 @AriX与@romainhuet探讨当代理程序能点击、输入并在后台持续工作时将带来哪些改变。

推荐理由:Codex 这个「computer use」不接管整台 Mac,只在后台帮你点、帮你打字,对用过 Cursor 接管全屏后心里发毛的开发者来说,是个更让人放心的设计,但有没有宣传的那么顺还得等实测。
01:54
Claude:Blog(网页)精选
AI 评分 73/100
Claude进军法律行业

Anthropic公司为法律行业发布20多个新的MCP连接器及12个专用插件,将Claude深度集成至合同管理、文档处理等法律核心软件栈。Claude现可直接在Microsoft Word、Outlook等办公应用中无缝工作,具备起草、修订、条款比对等可复用技能,并能自动化处理日常法律事务。公司同时宣布与多个司法公益组织合作,以扩大法律服务的可及性。


推荐理由:Claude 这次在法律行业的布局很大,20+ 连接器和 12 个插件意味着它不是做表面集成,而是把律师的整套工具链都拉了进来——对律所是效率革命,对做垂直 AI 产品的团队则是教科书级的行业解决方案示范。
01:53
GitHub Blog精选
AI 评分 61/100
GitHub Copilot 个人计划:在 Pro 和 Pro+ 中引入弹性配额,以及新的 Max 计划

GitHub 宣布从6月1日起更新 Copilot 个人计划阵容,基于用户反馈进行调整。主要变化包括在现有 Pro 和 Pro+ 计划中引入弹性配额机制,允许用户更灵活地分配使用量;同时新增 Max 计划,扩展高级选项。此次更新旨在提升计划的可定制性,为开发者提供更个性化的编程辅助服务,优化整体使用体验。


推荐理由:GitHub Copilot 个人版引入弹性配额和更贵的 Max 计划,对你这样每天靠它写代码的人,要么多花钱要么被限流,算清楚自己的用量比看功能列表更重要。
01:33
00:24
Claude:Blog(网页)精选
AI 评分 58/100
Code w/ Claude SF 2026开发者大会:基于AI指数级增长的构建

在Code w/ Claude SF 2026开发者大会上,Anthropic宣布提升开发者工具能力。Claude Code的速率限制翻倍,Claude Opus的API限制提高,以支持大规模可靠开发。同时,Claude平台上的托管智能体新增四项功能:“梦想”功能通过回顾会话优化记忆;多智能体编排支持主智能体并行委派子任务;“成果”功能通过定义输出标准提升任务成功率,内部测试显示最难问题成功率最多提升10%;Webhooks提供任务完成通知。大会主题演讲和分组会议录像已上线,并计划在伦敦和东京举办后续活动。


推荐理由:虽然已是旧闻,但Dreaming和Outcomes这两个功能让agent能自我改进,是构建生产级AI团队的真信号,做Claude开发的值得补课。

5月12日5月12日周二

星期二 · 7 条
22:40
Google DeepMind:Blog(RSS)精选
AI 评分 57/100
Co-Scientist:一个加速研究的多智能体AI伙伴

Co-Scientist 是一款由 Gemini 构建的协作式 AI 助手,旨在帮助科研人员加速科学突破。它通过多智能体(multi-agent)的架构设计,作为研究人员的智能伙伴参与工作流程,以提升研究效率并推动创新发现。


推荐理由:Google DeepMind 推出的科研助手,用多智能体框架帮科学家加速实验设计,如果做生物/材料领域研究,值得跟踪一下,但对其他领域暂时可能还是个概念。
04:01
OpenAI Developers@OpenAIDevs精选
AI 评分 69/100
Codex插件助力AI应用与智能体开发提速Codex can now help you build AI apps and agents faster with OpenAI APIs using the OpenAI Developers plugin.Codex现可通过OpenAI Developers插件,帮助您利用OpenAI API更快地构建AI应用和智能体。

推荐理由:把 Codex 直接接入 OpenAI API 开发流程,这是在给自家开发者递快刀,做 AI 应用和 Agent 的可以第一时间装上,省掉的不只是时间,还有调试的心力。
02:52
Claude Code:GitHub Releases(RSS)精选
AI 评分 72/100
Claude Code v2.1.139 版本更新

本次更新引入了多项新功能与优化。核心新增包括:集中管理会话的Agent视图(研究预览)、可设置目标并持续工作的/goal命令、实时调整滚轮速度的/scroll-speed命令,以及查看插件详情的claude plugin details命令。交互界面导航与控制能力得到增强。底层优化涵盖MCP服务器可获取CLAUDE_PROJECT_DIR环境变量、/context all的令牌估算会考虑模型分词器并显示舍入值。此外,修复了超过20项问题,如凭证死锁、内存无限制增长、权限规则、UI显示错误及路径处理等缺陷。


推荐理由:Claude Code 这波更新给了两个真正改变工作流的杀手功能,agent view 让你一眼看清所有会话,/goal 命令能让 Claude 自己跑完一个任务直到满足条件,做开发的同学可以立刻试试。
01:22
Claude:Blog(网页)精选
AI 评分 70/100
Anthropic在AWS上正式推出Claude平台

Anthropic公司正式在AWS上推出Claude平台,为AWS客户提供了通过其现有身份验证、账单及承诺消费抵扣使用完整Claude功能的新途径。该平台首次将全套Claude API功能引入AWS生态,新功能与原生API同日上线。平台包含Claude托管智能体、代码执行、文件API等多项核心功能,并支持最新模型。与Amazon Bedrock上的服务不同,此平台由Anthropic直接运营,数据在AWS边界外处理,适合需要完整平台体验的企业客户。服务将在多数AWS商业区域提供。


推荐理由:Anthropic 第一次把完整 Claude 平台功能全量搬到 AWS 上,用 AWS 账号就能直接拿原生 API 最新特性,对于 AWS 生态里的开发者是个省心的一站式选择,不用再纠结该走 Bedrock 还是原生。
00:02
凡人小北@frxiaobei精选
AI 评分 85/100
Anthropic开源金融AI全栈模板,定义行业落地新标准Anthropic:“我正在金融街”。走自己的路,让别人无路可走。Anthropic在GitHub开源了金融服务行业AI解决方案完整模板库,包含10个端到端智能体、7个垂直行业插件及11家主流金融数据商的MCP连接器,覆盖投研、投行、风控等核心工作流。该库提供了从个人插件到企业API的部署方式,支持集成至Microsoft 365及私有云。此举为金融AI落地提供了开箱即用的标准作业程序,与OpenAI的消费级路线形成鲜明对比,凸显了其深耕企业场景、通过开源构建行业生态的战略意图。

Jason Zhu: Anthropic 真的惊为天人 直接把金融服务行业的 AI 工作流模板全开源了 投资银行 / 股票研究 / 私募 / 财富管理 / 基金管理 / KYC 风控 七大业务线的参考 agent / 技能包 / 数据连接器 全部公开 这超出了 ...


推荐理由:Anthropic 把金融行业 AI 落地的完整 SOP 开源了,10 个 agent 加 11 家数据商 MCP 连接器,这不是 demo,是逼迫全行业在 Claude 轨道上长,金融 AI 格局就此定型。
00:00
LlamaIndex:产品、工程与评测精选
AI 评分 63/100
LlamaIndex 发布 LiteParse Server 可自托管文档解析服务

LlamaIndex 发布 liteparse-server,将 LiteParse 封装为可自托管的 HTTP 文档解析服务,支持 PDF、Word、PowerPoint、表格和图片,输出带 bounding box 的空间布局文本。


推荐理由:原文给出了接口、格式支持和两种部署模式的具体细节,读者可以据此评估自托管文档解析在隐私和成本上的取舍。

5月11日5月11日周一

星期一 · 2 条
22:30
OpenRouter@OpenRouter精选
AI 评分 76/100
帕累托代码以市场需求重塑模型选择Pareto Code is a new way of looking at the Pareto frontier using real market demandDeepSeek V4 Pro is taking the top position, followed by GPT 5.4 Mini and Gemini 3.1 Pro https://openrouter.ai/openrouter/pareto-codePareto Code 是一种利用真实市场需求观察帕累托前沿的新方法 DeepSeek V4 Pro 占据首位,其次是 GPT 5.4 Mini 和 Gemini 3.1 Pro https://openrouter.ai/openrouter/pareto-code

OpenRouter: Introducing Pareto Code: a new, free, experimental coding router Set `min_coding_score` in your request and route to the...


推荐理由:OpenRouter 这个实验性路由把模型选型从靠直觉变成了实时市场驱动的自动化决策,对预算敏感又看重编码质量的项目来说,是个值得一试的免费工具。
08:00
Claude Platform:开发者版本说明(RSS)精选
AI 评分 73/100
Claude Platform on AWS 发布

Anthropic 推出 Claude Platform on AWS,将 Claude API 部署在由 Anthropic 管理、可通过 AWS 访问的基础设施上,支持 AWS 账单和 IAM 身份验证。


推荐理由:Anthropic 把 Claude API 搬上 AWS 了,用 AWS 计费和原生 IAM,对于已经在 AWS 上的团队这就像打开了自家水龙头,延迟更低,账单还统一。