跳到正文

AA-LCR(Artificial Analysis)

Artificial Analysis / 知识与语言 · 读很长的文档后,回答需要综合推理的问题。

官方评测
在 AIHOT 中参与排名
所属领域知识与语言
上游数据时间待核实
最近成功同步10/04 20:23

它测什么,怎么测

取 Artificial Analysis 智能指数中 AA-LCR 的正确率。同一型号按最高推理档位选代表配置,选择不看分数。

如何使用这份证据

计分:知识与语言领域的长文理解一类。

评测成绩

按固定规则,每个公开模型采用一套代表配置;没有可采用配置的模型标为未计入并写明原因。匿名测试型号不展示,保留原榜名次,每项最多 30 个。

原榜名次原榜型号原始成绩代表配置
1kimi-k3Moonshot AI88.7%Max 推理
2step-5StepFun88.3%来源默认配置
3mimo-v2-6-proXiaomi86.3%来源默认配置
4claude-fable-5-1Anthropic85.3%Max 推理 · 含来源回退
5claude-opus-5-5Anthropic84.7%Max 推理 · 含来源回退
8gpt-5-5OpenAI84.3%xHigh 推理
11gpt-5-6-solOpenAI84.0%Max 推理
11deepseek-v4-1-flashDeepSeek84.0%Max 推理
15gpt-6-solOpenAI83.7%Max 推理
15gpt-5-6-lunaOpenAI83.7%Max 推理
19solar-mini4Upstage83.3%来源默认配置
19muse-glimmerMeta83.3%High 推理
19gpt-6-lunaOpenAI83.3%Max 推理
23gpt-6-1-solOpenAI83.0%Max 推理
23gpt-5-6-terraOpenAI83.0%Max 推理
23muse-spark-1-3Meta83.0%Max 推理
23minimax-m3MiniMax83.0%来源默认配置
23ling-3-1-flashInclusionAI83.0%来源默认配置
31claude-sonnet-5-5Anthropic82.7%Max 推理 · 含来源回退
33claude-fable-5Anthropic82.3%Max 推理 · 含来源回退
38gemini-3-1-pro-previewGoogle82.0%来源默认配置
38qwen3-8-27bAlibaba82.0%xHigh 推理
38claude-sonnet-5Anthropic82.0%Max 推理
42gemini-3-7-flashGoogle81.7%High 推理
45gemini-3-8-flashGoogle81.3%High 推理
45deepseek-v4-flash-visionDeepSeek81.3%Max 推理
49kimi-k2-6Moonshot AI81.0%来源默认配置
49grok-4-6-xhighxAI81.0%xHigh 推理
52gpt-6-astraOpenAI80.7%Max 推理
55qwen3-8-2-4t-a95bAlibaba80.3%来源默认配置
评测局限与数据署名

只考英文长文。

数据许可:Artificial Analysis 公开页面数据;展示须显著署名并链接来源,遵守其 Terms of Use

成绩由 Artificial Analysis 发布。各项评测的原始分数尺度不同,不能直接相加;AIHOT 按公开规则把它们换算到同一条能力刻度上。