AI 模型排行榜
汇集多种能力的真实评测,找到综合表现更强的模型。
21 项评测 · 10 家机构 · 09/16 03:10 更新综合榜 TOP 30
按多项公开评测的共同证据排名| 排名 | 模型 | 上线日期 | 评测证据 | 缓存价格人民币 / 百万 Token | 输入价格人民币 / 百万 Token | 输出价格人民币 / 百万 Token | 共识指数 ⓘ |
|---|---|---|---|---|---|---|---|
| 01 | GPT-6 AstraOpenAI | 20 项评测较充分 | ¥6.71 | ¥67.12 | ¥335.58 | 93.7 | |
| 02 | Claude Fable 5.1Anthropic | 17 项评测持续积累 | ¥1.68 | ¥67.12 | ¥335.58 | 93.7 | |
| 03 | Claude Fable 5Anthropic | 20 项评测持续积累 | ¥6.71 | ¥67.12 | ¥335.58 | 93.3 | |
| 04 | Claude Opus 5Anthropic | 21 项评测较充分 | ¥3.36 | ¥33.56 | ¥167.79 | 93.3 | |
| 05 | Muse Spark 1.3Meta | 12 项评测较充分 | — | ¥8.39 | ¥28.52 | 91.2 | |
| 06 | GPT-5.6 SolOpenAI | 21 项评测较充分 | ¥2.68 | ¥26.85 | ¥134.23 | 88.9 | |
| 07 | GLM-5.3Z.ai | 19 项评测证据敏感 | ¥1.75 | ¥9.4 | ¥29.53 | 85.7 | |
| 08 | Grok 4.6xAI | 18 项评测证据敏感 | ¥3.36 | ¥13.42 | ¥40.27 | 84.0 | |
| 09 | Kimi K3Moonshot AI | 20 项评测较充分 | ¥2 | ¥20 | ¥100 | 83.0 | |
| 10 | GPT-5.6 TerraOpenAI | 20 项评测证据敏感 | ¥1.34 | ¥13.42 | ¥80.54 | 80.5 | |
| 11 | Claude Opus 4.8Anthropic | 21 项评测证据敏感 | ¥3.36 | ¥33.56 | ¥167.79 | 78.8 | |
| 12 | Gemini 3.8 FlashGoogle | 19 项评测证据敏感 | ¥0.5 | ¥5.03 | ¥25.17 | 78.2 | |
| 13 | Qwen3.8 Max 0902Alibaba | 7 项评测证据敏感 | — | ¥12 | ¥36 | 77.7 | |
| 14 | GLM-5.3 FlashZ.ai | 17 项评测证据敏感 | ¥0.23 | ¥0.8 | ¥2.8 | 77.0 | |
| 15 | Claude Opus 4.7Anthropic | 19 项评测较充分 | ¥3.36 | ¥33.56 | ¥167.79 | 76.0 | |
| 16 | Qwen3.8 MaxAlibaba | 18 项评测证据敏感 | — | ¥12 | ¥36 | 73.9 | |
| 17 | Qwen3.8 Flash NextAlibaba | 5 项评测证据敏感 | — | ¥0.8 | ¥2.7 | 71.2 | |
| 18 | Muse Spark 1.2Meta | 14 项评测较充分 | — | ¥8.39 | ¥28.52 | 69.7 | |
| 19 | DeepSeek V4.1 FlashDeepSeek | 7 项评测证据敏感 | ¥0.0403 | ¥2.01 | ¥8.05 | 67.4 | |
| 20 | Gemini 3.7 FlashGoogle | 17 项评测证据敏感 | ¥0.5 | ¥5.03 | ¥25.17 | 65.7 | |
| 21 | Grok 4.5xAI | 19 项评测证据敏感 | ¥2.01 | ¥13.42 | ¥40.27 | 60.4 | |
| 22 | GPT-5.5OpenAI | 20 项评测证据敏感 | ¥3.36 | ¥33.56 | ¥201.35 | 60.2 | |
| 23 | GPT-5.4OpenAI | 13 项评测证据敏感 | ¥1.68 | ¥16.78 | ¥100.67 | 60.1 | |
| 24 | Claude Sonnet 5Anthropic | 20 项评测证据敏感 | ¥1.34 | ¥13.42 | ¥67.12 | 57.0 | |
| 25 | GPT-5.6 LunaOpenAI | 19 项评测证据敏感 | ¥0.13 | ¥1.34 | ¥8.05 | 54.4 | |
| 26 | DeepSeek V4 Pro 0813DeepSeek | 16 项评测较充分 | ¥0.3 | ¥9 | ¥27 | 53.7 | |
| 27 | DeepSeek V4 Flash 0731DeepSeek | 15 项评测证据敏感 | ¥0.1 | ¥3 | ¥9 | 49.3 | |
| 28 | Muse Spark 1.1Meta | 14 项评测证据敏感 | — | ¥8.39 | ¥28.52 | 48.5 | |
| 29 | Gemini 3.6 FlashGoogle | 18 项评测证据敏感 | ¥0.5 | ¥5.03 | ¥25.17 | 47.9 | |
| 30 | GLM-5.2Z.ai | 18 项评测证据敏感 | ¥2 | ¥8 | ¥28 | 44.2 |
每个榜单最多展示 30 个模型共识指数不是正确率;同分仍按共同证据确定的名次展示。
API 价格来自厂商官网,按每百万 Token 展示。美元报价按 2026-09-15 汇率折算成人民币。缓存价格指命中后的输入价格,缓存写入、存储及订阅费用另计。