Anthropic聘请埃森哲(由Faculty部门主导)作为拥有深度访问权限的外部安全审查方,覆盖模型评估、红队测试等,双方各自计划五年投入至少10亿美元
事件全貌
AI 综述Anthropic 宣布与 Accenture 建立独立的前沿 AI 评估合作,该合作由 Accenture 旗下 AI 业务部门 Faculty 牵头,内容包括评估与红队测试模型、开展对齐评估以及测试模型防护措施。Anthropic 表示,这是其 CEO 在《We Must Pace the Frontier》一文中承诺将评估者嵌入 Anthropic 内部的重要一步。双方各自预计在未来五年内至少投入 10 亿美元用于建设该领域能力,Anthropic 将直接资助 Accenture 的评估工作;Anthropic 还表示正与 METR 及其他非营利评估机构对话,以试点嵌入式评估的组成部分。
Anthropic 称该合作非独占:Anthropic 将在未来数周公布与其他评估方的合作,Accenture 也将以类似身份与其他 AI 开发者合作。
第三方账号 Rohan Paul 将这一安排描述为 Anthropic 聘请 Accenture 充当拥有异常深度内部访问权限的外部安全审查方,在 Claude 模型构建和测试期间介入,覆盖模型评估、红队测试、对齐评估与防护测试;该账号还指出,Accenture 将尝试攻破模型、检验安全规则是否真正有效,并审查 Anthropic 是否遵守自身安全承诺。该账号同时提出一个未解决的问题:由于是 Anthropic 自己付费给评估方,Accenture 在如此紧密地与被评判公司共事时能保持多大独立性。
另一第三方账号 Kim 称,Anthropic 再次被社区注释(community noted)。
AI 汇总报道生成 · 45分钟前更新。单篇报道保留其发布时的原貌。
第三方账号 Kim 称,Anthropic 再次被社区注释(community noted)。
报道时间线
沿着报道,了解事件的不同侧面。
- Anthropic 与 Accenture 独立评估合作遭质疑
Anthropic 宣布与 Accenture 合作开展前沿 AI 独立评估,双方预计未来五年各投入至少 10 亿美元建设相关能力。但 Kim 指出,负责 Anthropic 评估的 METR 近期被曝获得资金支持,独立性存疑,呼吁 Anthropic 就此发表公开声明。
- Anthropic 与 Accenture 合作开展嵌入式独立安全评估,双方各投入至少 10 亿美元
Anthropic 宣布与 Accenture 合作,对前沿 AI 做独立评估,是其承诺在内部嵌入外部评估者的一步。工作由 Accenture 旗下 Faculty 主导,涵盖模型评估、红队测试、对齐评估和防护措施测试;双方预计未来五年各投入至少 10 亿美元建设该领域能力,Anthropic 直接向 Accenture 支付评估费用。
- Anthropic 与 Accenture 合作开展嵌入式独立评估
Anthropic 宣布与 Accenture 合作,对其前沿模型开展嵌入式独立评估,合作由 Accenture 旗下 AI 业务 Faculty 主导,包括评估与红队测试、对齐评估和测试模型安全防护。