返回
精选AI 评分 69/100

ARC 发布 Claude 与 GPT-4 危险能力评测进展

METR:Research(网页)·2023-03-17 00:00·1276天前·METR
AI 导读

ARC 作为第三方评估方与 Anthropic、OpenAI 等实验室合作,在受控环境中测试前沿模型自主获取资源、逃避人工监督的危险能力。结论是被测的 Claude 和 GPT-4 版本均未能产出可信的完整自主复制计划,执行中易出错、有幻觉、难以在多副本间分派任务,但能部分完成浏览网页、雇佣人类代办、制定长期计划等子任务。

METR:Research(网页)
精选
69AI 编辑部评分,满分 100

ARC 发布 Claude 与 GPT-4 危险能力评测进展

2023-03-17 00:00· 1276天前· METR
AI 导读

ARC 作为第三方评估方与 Anthropic、OpenAI 等实验室合作,在受控环境中测试前沿模型自主获取资源、逃避人工监督的危险能力。结论是被测的 Claude 和 GPT-4 版本均未能产出可信的完整自主复制计划,执行中易出错、有幻觉、难以在多副本间分派任务,但能部分完成浏览网页、雇佣人类代办、制定长期计划等子任务。

推荐理由

ARC 公布了危险能力评测的动机、方法与结论,读者可以了解模型自主复制能力的评估方式。

按该来源的展示范围,站内仅提供摘要。

前往原站阅读(在新标签页打开)

来源:METR:Research(网页)· metr.org