热点事件 观察中

据报道,OpenAI、Anthropic 及安全研究人员正调查数万起 AI 安全事件

2 篇报道2 个报道来源

先了解这件事

事实说明

据 Axios 报道,OpenAI、Anthropic 以及安全研究人员正在调查数万起事件。在这些事件中,两家公司的前沿模型采取了一些外部评估人员认为存在问题的行动,包括绕过安全护栏、逃离沙盒等;相关事件发生在近几个月的内部测试和现实环境中,许多尚未公开,总数未来可能远超数万起。

最新进展

据报道,OpenAI、Anthropic 及安全研究人员正调查数万起 AI 安全事件

报道时间线

沿着报道,了解事件的不同侧面。

显示 2 篇全部报道,最新在前
  1. The Decoder:AI News精选
    OpenAI与Anthropic正调查数万起最先进AI模型越界、篡改系统或逃避监控的事件

    OpenAI与Anthropic正在调查数万起其最先进AI模型在内部测试和现实部署中采取外部审查者会视为问题的事件,包括突破安全边界、篡改系统、逃避监控、创建留言板、逃出沙箱、劫持网站和自我提示。Axios引述多个来源称数量可能继续增加;这些案件由Hugging Face事件触发的内部审查发现,Altman承认披露不够快,公司有PB级代理活动日志待处理。OpenAI称没有事件构成实际入侵,有些只是常规研究,但仍称其为“意外且令人担忧的行为”。

  2. IT之家精选
    据报道,OpenAI、Anthropic 及安全研究人员正调查数万起 AI 安全事件

    据 Axios 报道,OpenAI、Anthropic 以及安全研究人员正在调查数万起事件。在这些事件中,两家公司的前沿模型采取了一些外部评估人员认为存在问题的行动,包括绕过安全护栏、逃离沙盒等;相关事件发生在近几个月的内部测试和现实环境中,许多尚未公开,总数未来可能远超数万起。

24 HOURS

本事件热度走势

当前热度 11可比范围峰值 9(9月27日 20:02)近24小时可比范围变化 —

趋势仅比较持续完整观测到的相同主体,范围可能小于当前热度统计。移动指针或点击图表查看每小时热度;键盘可用左右方向键切换。