Mercor研究:AI会计任务超越持证CPA
先了解这件事
2026年10月2日,X 用户 Rohan Paul(@rohanpaul_ai)转述 Mercor 一项研究结论,称在中短长度、定义清晰的会计任务上,前沿 AI 模型已比初级会计师更快更准,甚至超过研究中最优秀的人类。据其转述,Claude Opus 5 在该任务中 20 题全对(100%),数分钟内完成;12 名持证 CPA 得分从 0% 到约 90% 不等,多人未能在 3 小时内完成。图中数据显示,按每项评分标准成本计,Claude Opus 5 为 $0.21,无 AI 的会计师为 $10.35。作者据此提出,规则型工作不再是职业,而是一条提示词。同日 19:15,The Decoder 跟进报道该研究:12 名平均经验五年半的持证 CPA 完成简化的 APEX Accounting Benchmark 任务,当前模型在同类结构化记账任务上已几乎无错,而 18 个月前最佳模型还低于会计师约 37% 的平均分;报道同时指出 AI 仍无法独立结账。上述内容为对 Mercor 研究的转述与报道,具体细节与数据以原始研究为准。
AI 根据报道生成 · 18 分钟前更新
事件进展
2 个进展
- 10月2日 19:15 · 1 篇报道Mercor发布AI与会计师记账任务对比研究The Decoder:AI News:Mercor 研究:AI 在会计任务上速度和准确率超过持证会计师,但仍无法独立结账
- 10月2日 18:02 · 1 篇报道Rohan Paul:规则型工作不再是职业,而是一条提示词,Claude Opus 5 在会计任务上超越持证会计师Rohan Paul:Rohan Paul:规则型工作不再是职业,而是一条提示词,Claude Opus 5 在会计任务上超越持证会计师
报道时间线
沿着报道,了解事件的不同侧面。
- The Decoder:AI NewsMercor 研究:AI 在会计任务上速度和准确率超过持证会计师,但仍无法独立结账
Mercor 的研究让 12 名平均经验五年半的持证 CPA 完成简化的 APEX Accounting Benchmark 任务,当前模型在同类结构化记账任务上已几乎无错,而 18 个月前最佳模型还低于会计师约 37% 的平均分。
- Rohan PaulRohan Paul:规则型工作不再是职业,而是一条提示词,Claude Opus 5 在会计任务上超越持证会计师
Rohan Paul 转述 Mercor 的一项研究结论,称在中短长度、定义清晰的会计任务上,前沿 AI 模型已比初级会计师更快更准,甚至超过研究中最优秀的人类。作者指出 Claude Opus 5 在任务中 20 题全对(100%),数分钟内完成,而 12 名持证 CPA 得分从 0% 到约 90% 不等,多人未能在 3 小时内完成;图中数据显示按每项评分标准成本计,Claude Opus 5 为 $0.21,无 AI 的会计师为 $10.35。
本事件热度走势
还没有足够的连续观测数据,暂不绘制趋势。