热点事件 历史事件

Anthropic 于周二发布 Claude Mythos 5 模型,网络安全基准成绩较 Mythos Preview 略有提升

1 篇报道1 个精选信源

先了解这件事

报道摘要

Epoch AI 分析约十五个网络基准后认为,Mythos Preview 在漏洞利用开发上是巨大跃升,约领先既有趋势 7 个月,明显高于 GPT-5.5 的 2-3 个月;Mythos 5 又有适度提升。但在固定预算下的漏洞发现能力提升不那么确定,因为 Project Glasswing 可能带来支出大增;其优势更多体现在更低误报率和更好的漏洞严重性排序上。

摘自 Epoch AI:研究、数据与评测

报道时间线

沿着报道,了解事件的不同侧面。

显示 1全部报道最新在前
  1. Epoch AI:研究、数据与评测官方一手精选
    Epoch AI 分析 Claude Mythos 网络安全能力是否被夸大

    Epoch AI 分析约十五个网络基准后认为,Mythos Preview 在漏洞利用开发上是巨大跃升,约领先既有趋势 7 个月,明显高于 GPT-5.5 的 2-3 个月;Mythos 5 又有适度提升。但在固定预算下的漏洞发现能力提升不那么确定,因为 Project Glasswing 可能带来支出大增;其优势更多体现在更低误报率和更好的漏洞严重性排序上。