跳到正文
热点事件持续更新

论文:编码代理修复自身框架Bug能力不足

1 篇报道1 个报道来源2 小时前更新

先了解这件事

AI 综述

2026年10月3日,X 用户 Rohan Paul (@rohanpaul_ai) 分享并解读了一篇来自美国与中国多家实验室的论文。该论文提出 AgentBug-Smith,可将真实 GitHub bug 报告自动转为可运行测试,构建出持续增长的 200 个 bug 基准。研究显示,3 个编码智能体中表现最好的仅修复 9%,远低于常规软件 bug 约 40% 的修复率。论文同时指出,加入过往修复经验指南后,某智能体在 79 个未见 bug 上的正确修复数从 1 提升到 6。该报道未给出论文标题、作者名单及基准的具体构成细节。

AI 根据报道生成 · 2 小时前更新

报道时间线

沿着报道,了解事件的不同侧面。

10月3日
  1. Rohan Paul
    研究:编码智能体仅修复9%的智能体框架Bug

    美国与中国多家实验室的论文提出 AgentBug-Smith,可将真实 GitHub bug 报告自动转为可运行测试,构建出持续增长的 200 个 bug 基准。3 个编码智能体中表现最好的仅修复 9%,远低于常规软件 bug 约 40% 的修复率。加入过往修复经验指南后,某智能体在 79 个未见 bug 上的正确修复数从 1 提升到 6。

本事件热度走势

还没有足够的连续观测数据,暂不绘制趋势。