前 Cursor 核心架构师、现 xAI 工程师 poteto 刚发了句暴论,直接把全网的“计划模式”抽得粉碎: “别再对着 Agent 抠什么长篇大论的抽象计划了。 又长又漂亮的 Plan,除了给你制造一种‘我们推进得很高效’的虚假幻觉,本质上全是一堆没有着陆点的泡沫。”
这篇长文的标题极其性感,直接戳中了 2026 年所有开发者的痛处: 《如何管理一个比你还聪明的存在(Agent)?》
她在 Meta、Netflix、Cursor 摸爬滚打了上千万行代码,给出的工业级答案刀刀见肉:
很多人用 Agent 喜欢搞对抗性评审(Adversarial Review), 让 AI 写出 10 页纸的架构预案,人类在文字层面逐条挑刺; 但残酷的事实是:你一旦让 Agent 在抽象层面过度推演,它就会开始对着空气疯狂幻觉,编造出一堆现实中根本不会发生的伪边缘场景去自我防御。
真正的顶级工程做法只有一条: 别在计划还停留在抽象层时把它“煮得太熟”(Don't overcook abstract plans), 直接用代码原型(Prototyping with code)去约束它。
让它别光打字,直接去写最小可运行原型; 让它自己用测试工具(Verification Skills)跑一遍,把录屏、截图和报错事实拍在桌上自证; 人类别去当咬文嚼字的文字考官,人类唯一的职责,是给它装上那个“能判断它有没有说谎的物理地基”。
从 Prompting 到 Planning,很多人以为这是终点, 其实这两层全是在文字游戏里打转; 真正的工业分水岭叫 Verification(确定性核验)—— 能用真实代码自证结果的 Agent,才是那台能放心地跑在生产线上的发动机。