跳到正文
原文
凡人小北· @frxiaobei · X·· 14 分钟前AI 评分62
AI 导读

Anthropic 发布评估文章,测试智谱 GLM-5.3 的网络攻击能力,其在 Chrome V8 漏洞利用任务中的成功率接近 Claude Mythos Preview。

正文

Anthropic 专门写了一篇文章评估智谱 GLM-5.3,看完有点感慨:AI 的网络攻击能力,已经走到这一步了。

按他们的测试,GLM-5.3 在 Chrome V8 漏洞利用任务中的成功率,已经接近 Claude Mythos Preview。

更直观的是文章里提到的案例,研究人员让它在隔离环境里测试一款浏览器,它发现了几个未知漏洞,还把这些漏洞串起来,做出了一个访问后就能读取电脑文件的网页。

另一个案例里,GLM-5.3-Flash 根据已公开的漏洞信息,花了 8 小时做出可用的攻击链。人只投入了约 20 分钟,按 API 价格算,模型费用约 20 美元。

当然,这是 Anthropic 对竞争对手的评估,文章也在强调自家安全措施。但这些结果本身值得认真看。

对做安全的人来说,补丁发布后的时间窗口,恐怕还得继加加速。

https://www.anthropic.com/research/glm-5-3-and-the-spread-of-advanced-cyber-capabilities

来源:凡人小北 · x.com