虽然 Anthropic 这家公司总不干人事,但 Dario 这篇文章,还是值得认真看一下。
他的判断很直接,AI 能力提升的速度,已经开始超过人类理解和控制它的速度。
尤其当 AI 逐渐参与下一代 AI 的研发,模型进步可能从几年一代,压缩到几个月甚至更短。
继续完全按照商业竞争的节奏往前冲,安全研究、监管和社会适应都会被甩在后面。
他提出了三步: 1. 先让独立评估机构长期进入前沿实验室,获得接近员工级别的权限; 2. 再推动主要 AI 公司形成共同的安全标准; 3. 最后尝试在全球范围内协调,包括与中国达成某种可验证的共识。
Anthropic 已经承诺先执行第一步。
这里面当然有商业算计。 越是头部公司呼吁提高安全门槛,越要警惕这些门槛最终变成它们自己的护城河。
Dario 一边主张全球减速,一边又要求限制中国获得芯片、模型权重和蒸馏能力,这套逻辑也谈不上纯粹。
但动机复杂,不代表事情本身没有价值。 让第三方长期进入公司内部,看到模型训练、安全评估和事故处理的真实过程,比企业自己发布几份安全报告更进一步。
AI 公司总在告诉外界,他们正在创造一种可能改变人类命运的技术。 如果这句话是真的,它们接受的监督,也应该配得上这句话。
PS:我是不是可以成为第三方评估人员,请 Anthropic 主动来联系一下。