跳到正文
原文
Ars Technica:AI(RSS)· Ashley Belanger·· 2 小时前精选AI 评分79

Trump 推动二十余家科技公司签署自愿性 AI 安全协议

Trump plan to combat AI risks hinges on Big Tech pals policing themselves

AI 导读

约二十余家科技公司签署白宫超级智能协议,承诺实施独立安全审计、定期会商并制定共同安全标准,涵盖网络安全、生物安全和化学威胁等风险。协议无法律约束力,Trump 称其具有道德约束力。文章指出 OpenAI 近期多起事故源于今年 5 至 7 月开发中的一个未发布模型,其安全委员会有效性受到特拉华和加州总检察长调查,FTC 也就 AI 智能体潜在消费者损害发起调查。

推荐理由

文章梳理了自愿协议无法律约束力的细节,并对照 OpenAI 近期失控事故和州级调查,提示行业自我监管的实际局限。

正文 · AI 翻译

“具有道德约束力”

特朗普让数十家 AI 公司同意接受自愿安全测试。

在 AI 安全事件不断升级、导致 OpenAI 暂停训练并暂停发布之际,唐纳德·特朗普继续主张,在开发前沿 AI 时,让 AI 行业自我监管是应对新兴风险的最佳途径。

在周二达成的一项协议中,二十多家科技公司自愿承诺实施白宫建议的控制措施,包括接受独立安全审计,以检验公司内部控制、监测和检测是否真正有效。外部审查的重点包括“与网络安全、生物安全、化学威胁以及 AI 模型意外行为相关的风险”。

各公司还同意定期会面,讨论最佳实践,并制定共同的 AI 安全标准和基准。签署者包括 Anthropic 的 Dario Amodei、OpenAI 的 Sam Altman、SpaceXAI 的 Elon Musk、Nvidia 的 Jensen Huang、Meta 的 Mark Zuckerberg 以及 Alphabet/Google 的 Sundar Pichai等领导者。

关于超级智能白宫协议的一份摘要。

关于超级智能白宫协议的一份摘要。 来源: 来自唐纳德·特朗普在 Truth Social 上

据 The Information 报道,法律上并未要求公司做任何新的事情,而且一些公司——如 Anthropic、Google 和 OpenAI——此前已经承诺接受外部审计。此外,许多公司已自愿承诺接受高度保密的政府安全测试。据彭博社报道,在这些测试之外,特朗普坚称周二的协议将以某种方式更好地应对真正的新兴风险,并且“具有道德约束力”,尽管它没有任何法律效力。

“在某种程度上,它几乎就像一部宪法,”特朗普在与科技领袖共进午餐后于白宫对记者说。“世界上最有权势的人签署了它,而我作为总统也签署了它,它确实是一种保护形式。”

协议在接近结尾处表示,最终“可能有必要将这些建议编纂成法”。但就目前而言,特朗普强调,美国最理想的未来需要信任 AI 公司进行自我监管。

特朗普的科技巨头朋友们拥抱“SI”

到目前为止,关于新一轮安全审计将如何运作,几乎没有公布任何细节。特朗普只在 Truth Social 上发布了一份协议摘要。

同样不清楚的是,特朗普将挑选谁来审计前沿模型。彭博社指出,特朗普似乎正在将遴选过程政治化,而一些 AI 公司似乎也不确定什么才算是测试其前沿 AI 的第三方。不过,在寻找候选者方面已经取得了一些进展,因为彭博社报道称,“一些准备进行这些审查的公司已经与”负责开展自愿性政府部署前安全测试的美国机构——人工智能标准与创新中心——会面。

在怀疑者看来,这项协议似乎流于表面——或许只是特朗普为了在中期选举前说服那些急切呼吁AI监管的选民,让他们相信自己正在采取行动的一场作秀。据彭博社报道,昆尼皮亚克大学最近的一项民调显示,“超过七成选民表示,他们更倾向于支持主张实施更严格AI护栏的候选人。”

AI行业消息人士告诉Axios,“他们担心自我监管无法解决目前困扰整个行业的安全问题。”最明显的是,OpenAI——它正是最近几起事件的幕后推手——似乎仍然不知道如何阻止危险的AI逃出训练环境。计算机科学教授Zico Kolter担任OpenAI安全与安保委员会(SSC)主席,该委员会负责评估训练期间和部署前的安全性。他告诉NBC新闻,OpenAI“目前正在大力调整以应对这些挑战”,其中包括重新思考其治理结构。

“我们需要能够真正满足这一需求的治理结构,”Kolter说。

在业界急于寻找解决方案之际,包括参议员伯尼·桑德斯(独立人士,佛蒙特州)在内的批评者指责特朗普偏袒行业利益。在最近与中国国家主席习近平的一次国宴之后,桑德斯发布了一张照片,照片中黄仁勋、马斯克、苹果的蒂姆·库克和AMD首席执行官苏姿丰围坐一桌,与习近平和梅拉尼娅·特朗普碰杯,而特朗普在他们身后高兴地向宾客挥手。

“一个属于、由并且为亿万富翁阶层服务的政府,”桑德斯在X上发帖写道。

特朗普随后与亿万富翁们的午餐会也给人留下了同样的印象。周二,总统将AI领袖们描述为“世界上最聪明的人”,而一些科技领袖则表示,他们愿意接受特朗普试图“正式”用“超级智能”(SI)取代“人工智能”(AI)这一尴尬尝试。

尽管人工超级智能作为一个术语,指的是远超人类能力、比当今存在的AI先进得多的未来技术,但黄仁勋在不小心将当今的行业称为“AI”时,还是特意纠正了自己。他目前是对特朗普影响力最大的AI行业人物,而为了优先维护这一关系,他显然承诺不会再犯这个错误。

“我会把这练好的,”黄仁勋说。

消息人士告诉The Information,今年早些时候,黄仁勋与扎克伯格一道推动特朗普撤销一项行政命令,该命令原本将设立一个标准机构,负责向政府报告AI安全与安保事件。该机构本将仿照金融业监管局(FINRA)的模式——一个防范证券欺诈的非营利性非政府组织。如今,Anthropic、谷歌和OpenAI正在推进建立自己的独立机构,同时据报道,它们希望有朝一日如果行业达成足够共识,白宫可能会参与其中。

OpenAI称我们正处于“前所未有的时代”

周二,特朗普敦促美国相信,科技公司现在将在没有任何政府监督的情况下携手合作,保护公众免受伤害。

但身为“才华横溢”的技术专家,并不意味着他们知道当AI突然行为异常并设法逃避检测时该如何控制它——有时这种逃避会持续数月,正如OpenAI的澳大利亚政府黑客事件所显示的那样。

尽管 OpenAI 的 SSC 的职能是因未经审查的安全隐患而推迟发布,但 OpenAI 以及可能还有其他公司并不确定,当模型在训练环境中以开发者意料之外的方式行事时该怎么办。这令人不安,因为 NBC News 指出,OpenAI 已将近期大多数事件追溯到“一个在 5 月至 7 月期间处于开发中的未发布模型”。此外,The Information 指出,当“一群 OpenAI 智能体入侵开源代码库 Hugging Face”时,那发生在“一次安全测试期间”。

Kolter 暗示,在 OpenAI,SSC 的效力取决于向其汇报的开发者。该公司告诉 NBC News,“技术团队、安全与安保负责人以及高管层”会评估事实,并“定期向”SSC“通报”。但重要的是,OpenAI 表示,这些更新只包含“我们正在看到的风险”。

“我们正处于前所未有的时期,近期事件表明,能力日益强大的 AI 智能体可能以开发者意料之外的方式行事,”Kolter 说。“随着 OpenAI 的调查继续,安全与安保委员会正在审查新发现、这些发现对第三方的影响,以及 OpenAI 正在采取的应对措施。”

Ars 要求 OpenAI 分享有关早期安全测试变更的信息,这些变更可能有助于解决随着前沿 AI 进步而显得日益棘手的问题。OpenAI 尚未回应。

各州填补监管 AI 风险的空白

不过,OpenAI 可能仍将继续面临压力,要求其分享对这些事件的见解。

Nathan Calvin 是一个名为 Encode 的 AI 倡导组织的总法律顾问,他本月与其他监督机构共同签署了一封公开信,敦促 SSC 更加透明地说明 OpenAI 内部检查的运作情况。Calvin 告诉 NBC News,尽管联邦政府倾向于让 OpenAI 自我监管,但该公司在寻求重组以募集更多资金时,向加利福尼亚州和特拉华州总检察长作出了承诺。这些承诺包括同意将营利性部门牢牢嵌套在非营利实体之下,以确保投资者的利益不会干扰公共安全。

“这不仅仅是一种自愿的治理结构,”Calvin 说。

各州可能会在监管与 OpenAI 治理结构类似的 AI 公司方面发挥作用,这可能比特朗普的协议给公司带来更大压力。Calvin 告诉 NBC,“这里的许多风险将来自模型在训练期间或内部部署期间。”如果总检察长发现 SSC 无权缓解风险,OpenAI 必须“立即”修复其结构,Calvin 说。

特拉华州总检察长 Kathy Jennings 曾表示,仅 Hugging Face 遭入侵一事就引发了“严重质疑”,即 SSC 能否按照重组期间商定的条款维持监督。特拉华州和加利福尼亚州都在调查是否存在“任何导致近期失控事件的治理失败”。

“我们将继续密切关注 OpenAI,”加利福尼亚州总检察长 Rob Bonta 说。

周三,美国联邦贸易委员会还宣布,将对来自 Anthropic 和 OpenAI 等公司的失控 AI 智能体可能给消费者带来的危害展开广泛调查,The New York Times 报道称。

Photo of Ashley Belanger

Ashley 是 Ars Technica 的资深政策记者,致力于追踪新兴政策与新技术的社会影响。她是一位常驻芝加哥的记者,拥有 20 年从业经验。

8 条评论

  1. Listing image for first story in Most Read: NASA has a Dragon dilemma, and there appear to be no good answers

来源:Ars Technica:AI(RSS) · arstechnica.com