# Factory 基准测试 13 个模型，比较 AI 代码审查的质量与成本

- 来源：Factory 研究 / 产品（RSS）
- 发布时间：2026-04-29 08:00
- AIHOT 分数：66
- AIHOT 标记：精选
- AIHOT 链接：https://aihot.news/items/cmtym4203000prowse8f6lz1o
- 原文链接：https://factory.ai/news/code-review-benchmark

## 精选理由

原文给出13个模型在50个真实PR上的F1与成本数据，读者可按预算直接挑选代码审查模型。

## AI 摘要

Factory 对 13 个模型在来自 Sentry、Grafana、Keycloak、Discourse 和 Cal.com 的 50 个真实 PR 上做了代码审查基准，每个模型至少跑 3 次。

## 正文

按该来源的展示范围，站内仅提供摘要。

> 站内仅提供摘要，全文见原文。
