热点事件 历史事件
Anthropic 暂停最新模型两周的 RL 训练
先了解这件事
报道摘要OpenAI 因 OpenAI-Hugging Face 事件及即将推出的 Astra 模型可能达到关键网络安全能力阈值,暂时放缓模型扩展速度,包括暂停最新模型强化学习训练两周。公司正加强研究环境隔离、网络隔离与安全测试,并扩大思维链监控范围,要求整个训练过程中提供更强的对齐证据。目前涉及 Astra 的工作负载已适用最严格安全保障,但大量工作负载在迁移完成前仍处于暂停状态。
报道时间线
沿着报道,了解事件的不同侧面。
显示 1 篇全部报道,最新在前
- OpenAI 在网络关键能力时代放缓模型开发
OpenAI 因 OpenAI-Hugging Face 事件及即将推出的 Astra 模型可能达到关键网络安全能力阈值,暂时放缓模型扩展速度,包括暂停最新模型强化学习训练两周。公司正加强研究环境隔离、网络隔离与安全测试,并扩大思维链监控范围,要求整个训练过程中提供更强的对齐证据。目前涉及 Astra 的工作负载已适用最严格安全保障,但大量工作负载在迁移完成前仍处于暂停状态。