热点事件 观察中

Anthropic计划更严格筛选强化学习环境,并呼吁为可完全自动化AI研究的模型设定更高安全标准

1 篇报道1 个报道来源

先了解这件事

事实说明

Anthropic宣布计划更严格筛选强化学习环境,称有缺陷的训练环境是模型不对齐行为的主要来源,并正研发更好的对齐奖励、自动化安全场景生成及更强安全监控。公司同时呼吁为可能完全自动化AI研究的模型设定更高安全标准,认为公共政策应发挥更大作用;此立场与OpenAI近期呼吁的国际标准及部分研究者放慢发布的联署相呼应。

报道时间线

沿着报道,了解事件的不同侧面。

显示 1全部报道最新在前
  1. The Decoder:AI News精选
    Anthropic计划更严格筛选强化学习环境,并呼吁为可完全自动化AI研究的模型设定更高安全标准

    Anthropic宣布计划更严格筛选强化学习环境,称有缺陷的训练环境是模型不对齐行为的主要来源,并正研发更好的对齐奖励、自动化安全场景生成及更强安全监控。公司同时呼吁为可能完全自动化AI研究的模型设定更高安全标准,认为公共政策应发挥更大作用;此立场与OpenAI近期呼吁的国际标准及部分研究者放慢发布的联署相呼应。

24 HOURS

本事件热度走势

当前热度 10

暂无可比热度趋势,待连续观测积累后展示。