AIHOT MODEL INDEX
AI 模型排行榜
综合看实力,分类看所长。
从写代码到改仓库,看模型能不能把软件做出来。
3 项评测 · 3 家机构 · 09/10 06:31 更新编程榜 TOP 30
按多项公开评测的共同证据排名| 排名 | 模型 | 上线日期 | 评测证据 | 输入价格人民币 / 百万 Token | 输出价格人民币 / 百万 Token | 共识指数 ⓘ |
|---|---|---|---|---|---|---|
| 01 | Claude Fable 5.1Anthropic | 2 项评测证据敏感 | ¥67.08 | ¥335.39 | 95.7 | |
| 02 | Claude Opus 5Anthropic | 3 项评测较充分 | ¥33.54 | ¥167.7 | 92.2 | |
| 03 | GPT-6 AstraOpenAI | 3 项评测较充分 | ¥67.08 | ¥335.39 | 89.5 | |
| 04 | Claude Fable 5Anthropic | 3 项评测证据敏感 | ¥67.08 | ¥335.39 | 89.5 | |
| 05 | GPT-5.6 SolOpenAI | 3 项评测证据敏感 | ¥33.54 | ¥201.23 | 88.0 | |
| 06 | Gemini 3.8 FlashGoogle | 3 项评测证据敏感 | ¥5.03 | ¥25.15 | 77.8 | |
| 07 | GLM-5.3Z.ai | 3 项评测较充分 | ¥9.39 | ¥29.51 | 77.8 | |
| 08 | GPT-5.6 TerraOpenAI | 3 项评测证据敏感 | ¥13.42 | ¥80.49 | 72.8 | |
| 09 | Kimi K3Moonshot AI | 3 项评测证据敏感 | ¥20 | ¥100 | 72.8 | |
| 10 | Gemini 3.7 FlashGoogle | 2 项评测证据敏感 | ¥5.03 | ¥25.15 | 72.3 | |
| 11 | GPT-5.5OpenAI | 2 项评测证据敏感 | ¥33.54 | ¥201.23 | 72.3 | |
| 12 | Grok 4.6xAI | 3 项评测证据敏感 | ¥13.42 | ¥40.25 | 72.3 | |
| 13 | GLM-5.3 FlashZ.ai | 3 项评测证据敏感 | ¥0.8 | ¥2.8 | 65.4 | |
| 14 | Claude Opus 4.8Anthropic | 3 项评测证据敏感 | ¥33.54 | ¥167.7 | 63.8 | |
| 15 | Qwen3.8 MaxAlibaba | 3 项评测证据敏感 | ¥12 | ¥36 | 63.8 | |
| 16 | GPT-5.6 LunaOpenAI | 3 项评测证据敏感 | ¥1.34 | ¥8.05 | 59.3 | |
| 17 | Claude Sonnet 5Anthropic | 3 项评测证据敏感 | ¥13.42 | ¥67.08 | 57.3 | |
| 18 | Qwen3.8 27 BAlibaba | 2 项评测证据敏感 | ¥3 | ¥12 | 54.6 | |
| 19 | Muse Spark 1.1Meta | 2 项评测证据敏感 | ¥8.38 | ¥28.51 | 52.8 | |
| 20 | Muse Spark 1.2Meta | 2 项评测证据敏感 | ¥8.38 | ¥28.51 | 52.8 | |
| 21 | DeepSeek V4 Pro 0813DeepSeek | 2 项评测证据敏感 | ¥9 | ¥27 | 52.8 | |
| 22 | DeepSeek V4 Pro PreviewDeepSeek | 2 项评测证据敏感 | ¥2.92 | ¥5.84 | 42.3 | |
| 23 | Grok 4.5xAI | 3 项评测证据敏感 | ¥13.42 | ¥40.25 | 41.2 | |
| 24 | GPT-5.4OpenAI | 2 项评测证据敏感 | ¥16.77 | ¥100.62 | 38.5 | |
| 25 | DeepSeek V4 Flash PreviewDeepSeek | 2 项评测证据敏感 | ¥0.94 | ¥1.88 | 27.4 | |
| 26 | Gemini 3.6 FlashGoogle | 2 项评测证据敏感 | ¥5.03 | ¥25.15 | 27.4 | |
| 27 | GLM-5.2Z.ai | 2 项评测证据敏感 | ¥8 | ¥28 | 27.4 | |
| 28 | Gemini 3.5 FlashGoogle | 2 项评测证据敏感 | ¥10.06 | ¥60.37 | 27.0 | |
| 29 | Claude Sonnet 4.6Anthropic | 2 项评测证据敏感 | ¥20.12 | ¥100.62 | 24.4 | |
| 30 | DeepSeek V4 Flash 0731DeepSeek | 2 项评测证据敏感 | ¥3 | ¥9 | 24.4 |
每个榜单最多展示 30 个模型共识指数不是正确率;同分仍按共同证据确定的名次展示。
API 价格来自厂商官网,按每百万 Token 展示。美元报价按 2026-09-09 汇率折算成人民币;订阅费用另计。