热点事件 持续更新

Anthropic发布最新AI滥用报告:称已阻止使病毒更危险的请求,描述5个生物案例(含禽流感研究与涉军事研究所的基孔肯雅提案),封号后经销商数日内回归且研究继续,并因新模型风险扩大生物请求限制

4 篇报道3 个精选信源

事件全貌

AI 综述

Anthropic发布了2026年9月的《检测和应对人工智能的滥用》月度报告。报告声称,公司已阻止了旨在使病毒更危险的请求,并描述了5个生物案例,包括禽流感研究和一项涉及军事研究所的基孔肯雅病毒功能增益研究提案。

报告指出,封禁账户并未完全终止滥用访问:为基孔肯雅病毒研究人员服务的经销商在数日内回归,其研究得以继续。此外,报告称蒸馏可以提升通用推理能力,从而增加超出训练对话主题的危险能力,但未提供量化评估。报告也声称Claude的安全防护不会通过未授权的蒸馏转移。

报告中的生物安全章节进行了自我批评,记录了五个在职科学家的匿名案例。其中一个案例中,生物安全分类器阻止了一项在军事研究所进行的基孔肯雅病毒功能增益研究的资助申请。报告的结论是,在双重用途领域,无法可靠检测用户意图,分类器难以同时兼顾有用工作与防止伤害。作为回应,Anthropic在Claude Fable 5中针对双重用途生物请求和蒸馏引入了更严格的保障措施。

AI 汇总报道生成 · 23分钟前更新。单篇报道保留其发布时的原貌。

最新进展

最新情况详见事件全貌。

报道时间线

沿着报道,了解事件的不同侧面。

显示 4全部报道最新在前
  1. The Decoder:AI News精选
    Anthropic 威胁报告披露 Claude 被用于间谍软件、导弹与无人机研发,中国实验室大规模蒸馏提取数据

    Anthropic 发布威胁情报报告,记录 2025 年 12 月至 2026 年 8 月间 Claude 被滥用的七类行为。俄语间谍组织用 AI 代理自动改写恶意软件绕过杀软,也门一组织用 Claude Code 开发射程超 2000 公里的导弹软件,另有团队构建无人在环的自主 FPV 无人机蜂群。

  2. Hacker News 热门(buzzing.cc 中文翻译)
    Anthropic 发布 2026 年 9 月 AI 滥用检测与应对报告

    Anthropic 发布 2026 年 9 月 AI 滥用检测与应对报告,披露其识别和反制 AI 滥用的最新进展。该报告来自 Anthropic 官方,在 Hacker News 上获得 130 点热度。

  3. X:Rohan Paul (@rohanpaul_ai)
    Anthropic 报告称蒸馏可提升危险能力

    Anthropic 最新的“AI 滥用”报告称,知识蒸馏可以提升通用推理能力,足以将危险能力扩展到训练对话所涵盖范围之外。 报告还称,Claude 的安全防护无法通过未经授权的蒸馏转移,但未对这些说法提供量化评估。

  4. X:Rohan Paul (@rohanpaul_ai)
    Anthropic 2026 年 9 月滥用报告:拦截危险生物请求,指认 7 家中国实验室未经授权蒸馏 Claude

    Anthropic 发布 2026 年 9 月滥用检测报告,称已拦截旨在增强病毒危险性的请求,并描述了 5 起生物滥用案例,涉及禽流感研究和一份来自军方研究机构的基孔肯雅热资助申请书。