热点事件 观察中
Anthropic计划更严格筛选强化学习环境,并呼吁为可完全自动化AI研究的模型设定更高安全标准
先了解这件事
事实说明Anthropic宣布计划更严格筛选强化学习环境,称有缺陷的训练环境是模型不对齐行为的主要来源,并正研发更好的对齐奖励、自动化安全场景生成及更强安全监控。公司同时呼吁为可能完全自动化AI研究的模型设定更高安全标准,认为公共政策应发挥更大作用;此立场与OpenAI近期呼吁的国际标准及部分研究者放慢发布的联署相呼应。
报道时间线
沿着报道,了解事件的不同侧面。
显示 1 篇全部报道,最新在前
- Anthropic计划更严格筛选强化学习环境,并呼吁为可完全自动化AI研究的模型设定更高安全标准
Anthropic宣布计划更严格筛选强化学习环境,称有缺陷的训练环境是模型不对齐行为的主要来源,并正研发更好的对齐奖励、自动化安全场景生成及更强安全监控。公司同时呼吁为可能完全自动化AI研究的模型设定更高安全标准,认为公共政策应发挥更大作用;此立场与OpenAI近期呼吁的国际标准及部分研究者放慢发布的联署相呼应。
24 HOURS
本事件热度走势
当前热度 10
暂无可比热度趋势,待连续观测积累后展示。