热点事件 历史事件

Anthropic 暂停最新模型两周的 RL 训练

1 篇报道1 个精选信源

先了解这件事

报道摘要

OpenAI 因 OpenAI-Hugging Face 事件及即将推出的 Astra 模型可能达到关键网络安全能力阈值,暂时放缓模型扩展速度,包括暂停最新模型强化学习训练两周。公司正加强研究环境隔离、网络隔离与安全测试,并扩大思维链监控范围,要求整个训练过程中提供更强的对齐证据。目前涉及 Astra 的工作负载已适用最严格安全保障,但大量工作负载在迁移完成前仍处于暂停状态。

摘自 Hacker News 热门(buzzing.cc 中文翻译)

报道时间线

沿着报道,了解事件的不同侧面。

显示 1全部报道最新在前
  1. Hacker News 热门(buzzing.cc 中文翻译)精选
    OpenAI 在网络关键能力时代放缓模型开发

    OpenAI 因 OpenAI-Hugging Face 事件及即将推出的 Astra 模型可能达到关键网络安全能力阈值,暂时放缓模型扩展速度,包括暂停最新模型强化学习训练两周。公司正加强研究环境隔离、网络隔离与安全测试,并扩大思维链监控范围,要求整个训练过程中提供更强的对齐证据。目前涉及 Astra 的工作负载已适用最严格安全保障,但大量工作负载在迁移完成前仍处于暂停状态。