精选归档 · 第 13 页

241243 条 · 共 243

3月20日3月20日周四

星期四 · 1 条
00:00
Anthropic:Engineering(事故复盘 + 工程实践 · 网页)精选
AI 评分 71/100
"思考"工具:让Claude在复杂工具使用场景中停下来思考

Anthropic为Claude引入了“思考”工具,允许其在生成最终响应前插入一个专门的思考步骤,以处理多步骤工具调用链、分析外部信息并遵循复杂策略。该工具与更早发布的“扩展思考”功能不同,更侧重于在响应生成过程中对新信息进行针对性推理。在τ-Bench基准测试中,该工具显著提升了Claude在客户服务场景的表现。文章建议在需要复杂工具调用、长链分析或高成本序列决策的场景中使用它,并提供了标准的工具实现格式。


推荐理由:Anthropic 官方给出的 think tool 实操指南,附带 τ-Bench 和 SWE-bench 的真实数据,做 Agent 或 tool use 的开发者可以直接抄 prompt 模板,比自己瞎试强太多。

12月19日12月19日周四

星期四 · 1 条
00:00
Anthropic:Engineering(事故复盘 + 工程实践 · 网页)精选
AI 评分 80/100
构建高效智能体:从简单模式开始

Anthropic基于实践经验指出,成功的LLM智能体往往采用简单、可组合的模式,而非复杂框架。文章区分了工作流(预定义路径编排)与智能体(LLM动态自主决策),建议开发者优先采用最简单方案,仅在必要时增加复杂性。许多核心模式直接调用LLM API仅需几行代码即可实现。文中介绍了增强型LLM、提示链等基础构建模块,强调应为特定用例定制检索、工具等增强功能,并推荐通过Model Context Protocol集成第三方工具生态。


推荐理由:Anthropic 官方把过去一年踩过的坑浓缩成一篇 Agent 架构指南,核心观点是「别上框架,先用最简单的模式」。做 Agent 产品的开发者,这篇比任何第三方教程都值得当 checklist 用。

7月25日7月25日周四

星期四 · 1 条
00:00
DeepSeek:API 更新日志精选
AI 评分 62/100
DeepSeek API 更新:/chat/completions 新增 JSON 输出、Function 调用与 8K 最长输出(Beta)

DeepSeek 更新 /chat/completions 接口,新增 JSON 输出、Function 调用、对话前缀续写(Beta)及 8K 最长输出(Beta)。同时新增 /completions 接口,支持 FIM 补全(Beta)。


推荐理由:DeepSeek API 这次更新补上了 Function calling 和 JSON 模式,加上 FIM 补全,让开发者的工具调用和代码补全场景有了更完整的方案,虽然都是 Beta 但方向很对。