该来源未收录可展示正文,站内仅提供摘要。
阅读原文(在新标签页打开)Epoch AI 评审 ExploitBench v0.1:基于 41 个真实 V8 漏洞的利用基准评测
AI 导读
Epoch AI 发布对 ExploitBench v0.1 的基准评审,该基准用 41 个真实公开 V8 CVE,按 5 层 16 项可验证能力阶梯为模型打分,最高到任意代码执行(ACE)。
Epoch AI:研究、数据与评测
精选
60
AI 编辑部评分,满分 100Epoch AI 评审 ExploitBench v0.1:基于 41 个真实 V8 漏洞的利用基准评测
Epoch AI 发布对 ExploitBench v0.1 的基准评审,该基准用 41 个真实公开 V8 CVE,按 5 层 16 项可验证能力阶梯为模型打分,最高到任意代码执行(ACE)。
推荐理由
Epoch AI 独立评审 ExploitBench 的评分设计与局限,读者可借此理解如何解读该基准的模型分数与污染风险。
来源:Epoch AI:研究、数据与评测· epoch.ai