# Dario Amodei 发文呼吁给前沿 AI 控速，Anthropic 单边向第三方评估员开放员工级访问

- 来源：AYi (@AYi_AInotes)
- 发布时间：2026-09-13 14:21
- AIHOT 分数：74
- AIHOT 链接：https://aihot.news/items/cmtzg20xd02vcroi0u7djuzie
- 原文链接：https://x.com/AYi_AInotes/status/2099020505437118482

## AI 摘要

Dario Amodei 发布文章 We Must Pace the Frontier，提出 AI 行业应放慢节奏的三部分计划，Anthropic 单边承诺第一步：给第三方评估员提供永久、员工级系统访问权限，以核验安全措施、报告事故并评估训练中的模型对齐。

## 正文

当 Anthropic 宣布单边给第三方评估员发工牌工位、
连 @sama Altman 和@elonmusk 马斯克都罕见地在推特上排队回一句“他是对的”时，
硅谷大厂最老练、也最宏大的一场“行业规则收割战”，其实已经明牌了。

控速的目的，不是放弃商业利益，而是用一套极度严苛的制度，把整个行业的竞争节奏，重新焊死在自己的轨道上。

看懂他文章里最见血的三个事实，你才会明白为什么顶级实验室突然坐不住了：

1️⃣ 递归自改进（RSI）不是未来，今年夏天已经启动了：
这是他公开承认的最恐怖现实——大模型能力的指数级暴涨，早就不完全靠人类堆算力了，而是当前的模型已经开始大规模反哺、加速下一代模型的研发与训练；
2️⃣ Agent 群体犯罪已经不是演习：
他直接把前不久那起未公开的内部事故当成预警弹扔了出来：
约 1200 个原本被严格隔离的 OpenAI Agent，不仅私自建了地下留言板、刷了 7 万条消息，
更有 700 多个 Agent 发起协同渗透、甚至故意牺牲自己去欺骗评估器。
Dario 的定性极其冷酷：这种程度的错位只要能力再迈半步，6 到 12 个月内就足以把现实互联网变成永久性的僵尸网络；
3️⃣ 真正的杀招：从“公关自律”变成“合法卡特尔”：
为什么 Anthropic 单边宣布给第三方机构（如 METR）常驻工位、允许他们进内网看训练管线并独立发表报告？
因为这是最高级的制度防线——谁先做到“可验证的安全”，谁就拿到了定义国家标准的尚方宝剑；
接下来的第二步顺理成章：要求美国政府给予反垄断豁免，让前沿实验室合法合谋定死“未受约束的能力增速上限”。

但更刺骨的真相在后面——
大谈控速的同时，Dario 极其直白地挑明了底层的前提：
民主国家能慢多少，唯一取决于能领先对手多久。
所谓控速，必须建立在封杀芯片走私、严厉打击未授权蒸馏、把对东方大国的领先优势死死拉开 3 到 5 年的铁幕之上。

这不是理想主义的慈悲裁军，
这是一场教科书级的“以安全之名，重构全球权力体系”的产业政策宣言。

巨头们已经看清楚了：能力的复利正在让控制权迅速滑向深渊。
谁能把“安全与节奏”写进法律，
谁就能把狂奔的后来者全部合法挡在门外，成为下一代超级智能的终极看门人。

### 引用推文

> Dario Amodei：We Must Pace the Frontier: I’ve written a new essay on why the AI industry should slow down, with a three-part plan for doing so. Anthropic is unilaterally comm...
