前 Cursor 枀장架构师 poteto 谆谈如何管理比自己聪明的 Agent:别过度打磨抽象计划

AYi · @AYi_AInotes · X·2026-09-10 09:18·26分钟前
AI 导读

前 Cursor 核心架构师、现 xAI 工程师 poteto 发文《如何管理一个比你还聪明的存在(Agent)》,认为长篇抽象计划只会制造虚假推进感,Agent 会在抽象层面过度推演并幻觉出伪边缘场景。

AYi@AYi_AInotes
64AI 编辑部评分,满分 100

前 Cursor 枀장架构师 poteto 谆谈如何管理比自己聪明的 Agent:别过度打磨抽象计划

2026-09-10 09:18· 26分钟前
AI 导读

前 Cursor 核心架构师、现 xAI 工程师 poteto 发文《如何管理一个比你还聪明的存在(Agent)》,认为长篇抽象计划只会制造虚假推进感,Agent 会在抽象层面过度推演并幻觉出伪边缘场景。

前 Cursor 核心架构师、现 xAI 工程师 poteto 刚发了句暴论,直接把全网的“计划模式”抽得粉碎: “别再对着 Agent 抠什么长篇大论的抽象计划了。 又长又漂亮的 Plan,除了给你制造一种‘我们推进得很高效’的虚假幻觉,本质上全是一堆没有着陆点的泡沫。”

这篇长文的标题极其性感,直接戳中了 2026 年所有开发者的痛处: 《如何管理一个比你还聪明的存在(Agent)?》

她在 Meta、Netflix、Cursor 摸爬滚打了上千万行代码,给出的工业级答案刀刀见肉:

很多人用 Agent 喜欢搞对抗性评审(Adversarial Review), 让 AI 写出 10 页纸的架构预案,人类在文字层面逐条挑刺; 但残酷的事实是:你一旦让 Agent 在抽象层面过度推演,它就会开始对着空气疯狂幻觉,编造出一堆现实中根本不会发生的伪边缘场景去自我防御。

真正的顶级工程做法只有一条: 别在计划还停留在抽象层时把它“煮得太熟”(Don't overcook abstract plans), 直接用代码原型(Prototyping with code)去约束它。

让它别光打字,直接去写最小可运行原型; 让它自己用测试工具(Verification Skills)跑一遍,把录屏、截图和报错事实拍在桌上自证; 人类别去当咬文嚼字的文字考官,人类唯一的职责,是给它装上那个“能判断它有没有说谎的物理地基”。

从 Prompting 到 Planning,很多人以为这是终点, 其实这两层全是在文字游戏里打转; 真正的工业分水岭叫 Verification(确定性核验)—— 能用真实代码自证结果的 Agent,才是那台能放心地跑在生产线上的发动机。

laurenPart 2 is here! Let's learn the art of supervising someone smarter than you. https://x.com/i/article/2094940651607715840