热点事件 持续更新

Anthropic聘请埃森哲(由Faculty部门主导)作为拥有深度访问权限的外部安全审查方,覆盖模型评估、红队测试等,双方各自计划五年投入至少10亿美元

3 篇报道3精选信源

事件全貌

AI 综述

Anthropic 宣布与 Accenture 建立独立的前沿 AI 评估合作,该合作由 Accenture 旗下 AI 业务部门 Faculty 牵头,内容包括评估与红队测试模型、开展对齐评估以及测试模型防护措施。Anthropic 表示,这是其 CEO 在《We Must Pace the Frontier》一文中承诺将评估者嵌入 Anthropic 内部的重要一步。双方各自预计在未来五年内至少投入 10 亿美元用于建设该领域能力,Anthropic 将直接资助 Accenture 的评估工作;Anthropic 还表示正与 METR 及其他非营利评估机构对话,以试点嵌入式评估的组成部分。

Anthropic 称该合作非独占:Anthropic 将在未来数周公布与其他评估方的合作,Accenture 也将以类似身份与其他 AI 开发者合作。

第三方账号 Rohan Paul 将这一安排描述为 Anthropic 聘请 Accenture 充当拥有异常深度内部访问权限的外部安全审查方,在 Claude 模型构建和测试期间介入,覆盖模型评估、红队测试、对齐评估与防护测试;该账号还指出,Accenture 将尝试攻破模型、检验安全规则是否真正有效,并审查 Anthropic 是否遵守自身安全承诺。该账号同时提出一个未解决的问题:由于是 Anthropic 自己付费给评估方,Accenture 在如此紧密地与被评判公司共事时能保持多大独立性。

另一第三方账号 Kim 称,Anthropic 再次被社区注释(community noted)。

AI 汇总报道生成 · 45分钟前更新。单篇报道保留其发布时的原貌。

最新进展

第三方账号 Kim 称,Anthropic 再次被社区注释(community noted)。

报道时间线

沿着报道,了解事件的不同侧面。

显示 3全部报道最新在前
  1. X:Kim (@kimmonismus)
    Anthropic 与 Accenture 独立评估合作遭质疑

    Anthropic 宣布与 Accenture 合作开展前沿 AI 独立评估,双方预计未来五年各投入至少 10 亿美元建设相关能力。但 Kim 指出,负责 Anthropic 评估的 METR 近期被曝获得资金支持,独立性存疑,呼吁 Anthropic 就此发表公开声明。

  2. X:Rohan Paul (@rohanpaul_ai)
    Anthropic 与 Accenture 合作开展嵌入式独立安全评估,双方各投入至少 10 亿美元

    Anthropic 宣布与 Accenture 合作,对前沿 AI 做独立评估,是其承诺在内部嵌入外部评估者的一步。工作由 Accenture 旗下 Faculty 主导,涵盖模型评估、红队测试、对齐评估和防护措施测试;双方预计未来五年各投入至少 10 亿美元建设该领域能力,Anthropic 直接向 Accenture 支付评估费用。

  3. Anthropic:Newsroom官方一手精选
    Anthropic 与 Accenture 合作开展嵌入式独立评估

    Anthropic 宣布与 Accenture 合作,对其前沿模型开展嵌入式独立评估,合作由 Accenture 旗下 AI 业务 Faculty 主导,包括评估与红队测试、对齐评估和测试模型安全防护。