模型一直在变,但你在模型外面搭的这套规则系统,才是真正能复利的技术资产。 看完 Anthropic 这位女工程师在终端里的架构推演,你才会明白工业级 Agent 到底是靠什么跑通生产环境的,
也别再把时间浪费在抠提示词上了,那种靠微调句子指望 AI 别犯错的做法,本质上全是在拼运气。
Anthropic 的 Claude Code 工程师在这场 1 小时的内部工作坊里,说出了一句最刺痛人的大实话: “一段更好的 Prompt 只能帮你救回一次回答; 而一套可靠的 Harness(脚手架工程),才能保证你的 Agent 每次出动都能稳定交付。”
同一套大模型,裸奔调用只会死循环、丢上下文、挑错工具; 但在工业级的 Harness 约束下,它能在真实代码库里连续自主狂奔几个小时。
视频里这位工程师面对一个纯空白终端,把生产级 Agent 的五层脚手架给拆得透彻见底:
• 00:23 Agent Loop 的底层自愈机制: 工具调用、状态管理与上下文流转,到底是怎么让它跑通闭环的; • 02:16 项目级持久说明书(CLAUDE.md)与 Plan Mode: 别让它一上来就改代码!先用极简规范固定边界,用规划模式(Plan Mode)在动笔前把题目重述清楚; • 11:23 打造你的专属技能与钩子(Skills & Hooks): 核心绝杀——在 Agent 执行任何操作的前后,用 Hooks 挂载自动化测试与权限审计,从物理层掐死它越权或者编造结果的可能; • 37:10 主管与小队(Subagents vs Agent Teams): 让一个 Agent 负责拆解调度、派出多个子 Agent 并行干活并强制上下文物理隔离,彻底解决长任务上下文被撑爆的痛点; • 59:38 用 Claude Agent SDK 搭建生产级系统: 把终端里的实操直接落成可长期运转的私有服务。
很多人把“调教 AI”当成玄学, 但一线大厂的实践早就在明牌告诉你: 模型智力早就过线了,真正值钱的是你在它身体外面搭的那套制度—— 规则、记忆、权限门禁、测试闭环与子任务隔离。
模型会不断推陈出新, 但你的 Harness 才是你团队真正能够沉淀下来的核心资产。
1 小时全程在终端和编辑器里真刀真枪演示,含金量直接秒杀市面上所有几百刀的培训课。建议所有做 AI 自动化和全栈开发的朋友,关掉手机打扰完整吃透一遍。 https://x.com/iiiichigo_chan/status/2098123682530955477/video/1