← 评测来源
Artificial Analysis

Artificial Analysis Intelligence Index

把多项当前评测放到同一套环境里复跑,得到一个综合能力分。价格只作参考,不进总分。

官方评测 ↗
在 AIHOT 中参与排名
证据预算30%
上游数据时间待核实
最近成功同步09/10 06:31

它测什么,怎么测

只取官方 Artificial Analysis Intelligence Index;接口中的性能与价格字段不计分。

如何使用这份证据

综合任务证据占 30%;已核对 v4.3 的 10 项底层评测,与现役专项没有重复计票。整项保留,不将聚合分冒充单项成绩。

评测成绩

按固定规则,每个公开模型采用一套代表配置。匿名测试型号不展示,保留原榜名次,每项最多 30 个。

原榜名次原榜型号原始成绩代表配置
3gpt-6-astraOpenAI52.8Max 推理
7claude-opus-5Anthropic50.7Max 推理 · 自适应
12muse-spark-1-3Meta48.2Max 推理
14gpt-5-6-solOpenAI47.1Max 推理
20glm-5-3Z.ai44.9Max 推理
22grok-4-6-xhighxAI44.3xHigh 推理
24kimi-k3Moonshot AI43.8Max 推理
27gpt-5-6-terraOpenAI42.3Max 推理
28qwen3-8-flash-nextAlibaba42.2来源默认配置
29claude-opus-4-8Anthropic42Max 推理 · 自适应
30glm-5-3-flashZ.ai41.9来源默认配置
31gemini-3-8-flashGoogle41.2High 推理
32claude-opus-4-7Anthropic40.7Max 推理 · 自适应
33qwen3-8-maxAlibaba40.3来源默认配置
34qwen3-8-2-4t-a95bAlibaba40来源默认配置
36muse-spark-1-2Meta39.8xHigh 推理
40gemini-3-7-flashGoogle39.4High 推理
41grok-4-5xAI39.1High 推理
42gpt-5-4OpenAI39xHigh 推理
43glm-5-2Z.ai38.6Max 推理
43gpt-5-5OpenAI38.6xHigh 推理
45claude-sonnet-5Anthropic38.4Max 推理 · 自适应
47gpt-5-6-lunaOpenAI37.5Max 推理
50deepseek-v4-proDeepSeek36.3Max 推理
52agnes-2-5-pro-betaSapiens AI35.2来源默认配置
53deepseek-v4-flash-visionDeepSeek35Max 推理
55deepseek-v4-flashDeepSeek34.5Max 推理
58gemini-3-6-flashGoogle34.3High 推理
58muse-spark-1-1Meta34.3xHigh 推理
61qwen3-8-27bAlibaba33.9xHigh 推理
评测局限与数据署名

缺少 API key 时整张来源退出本轮,不补 50 分;严禁用网页抓取替代,展示时必须署名并保留指数版本。

数据许可:API 数据展示或分享须显著署名;再分发权与定制条款须另行取得并遵守 Terms of Use

成绩由 Artificial Analysis 发布,原始分数与 AIHOT 共识分使用不同尺度,不能直接相加。