Anthropic报告约3万个内部代理监控数据:8月拦截0.002%决策,7月约6%研究算力用于安全
先了解这件事
事实说明Anthropic报告其最常用内部平台同时运行约3万个代理,实时监控在8月超10亿次决策中拦截了0.002%;第二套事后监控每周标记约10万条日志,约50条由人工处理。公司承认监控仅运行数月,无法确定覆盖所有行为模式。另外,7月样本周约6%的AI研究算力投入安全工作,公司称该比例低不代表安全工作少。
报道时间线
沿着报道,了解事件的不同侧面。
- Anthropic报告约3万个内部代理监控数据:8月拦截0.002%决策,7月约6%研究算力用于安全
Anthropic报告其最常用内部平台同时运行约3万个代理,实时监控在8月超10亿次决策中拦截了0.002%;第二套事后监控每周标记约10万条日志,约50条由人工处理。公司承认监控仅运行数月,无法确定覆盖所有行为模式。另外,7月样本周约6%的AI研究算力投入安全工作,公司称该比例低不代表安全工作少。
- Anthropic发布内部测量快照:截至2026年8月约30,000个智能体同时从事研发工程工作
Anthropic发布内部测量快照,称截至2026年8月,其最常用内部平台约有30,000个智能体同时从事研发和工程工作。
- Anthropic发布'Illuminating the Frontier'测量报告:披露AI研发自动化、代理监督与算力分配的内部快照
Anthropic发布博文,公布三类测量的原型指标和内部快照数据,包括截至2026年8月Claude'领导'26%的Anthropic AI R&D工作、约30,000个代理的监督覆盖率100%、以及2026年7月13日起一周约6%的AI R&D算力用于安全。文中称这些数字在协调放缓前沿AI发展的情况下会变化,且测量仅覆盖其最常用内部平台。
- Anthropic发布测量前沿实验室AI发展速度的三类指标及内部数据快照
Anthropic发布文章,提出测量前沿AI发展的三类工具:AI主导AI研发程度(截至2026年8月,Claude“主导”约26%的Anthropic AI研发工作,“协作”及以上占比超90%,尚无任何子集完全自主运行)、AI智能体监督(截至2026年8月内部平台约3万个研发智能体,100%动作经在线/离线监测,超10亿次决策中0.002%被拦截)和算力分配(所考察一周内约6%的AI研发算力用于安全工作,约12%的AI驱动AI研发算力用于安全,估算刻意保守),并计划引入独立第三方评估者验证安全实践、报告事件并监测这些指标;这些数字可能因前沿协调减速而变化。
本事件热度走势
暂无可比热度趋势,待连续观测积累后展示。