小米 MiMo-V2.6-Pro 登上 Code Arena: WebDev 榜约第10名,开源权重中约第3

Arena.ai · @arena · X·2026-09-22 05:08·22分钟前
AI 导读

小米发布 MiMo-V2.6-Pro 与 Flash 两款全模态模型,MiMo-V2.6-Pro 在 Code Arena: WebDev 榜以 1628 分(AutoEval)位列约第10名,开源权重(MIT 许可)中约第3,较 MiMo-V2.5-Pro 的 1475 分上涨 153 分。

Arena.ai@arena
精选
66AI 编辑部评分,满分 100

小米 MiMo-V2.6-Pro 登上 Code Arena: WebDev 榜约第10名,开源权重中约第3

2026-09-22 05:08· 22分钟前
AI 导读

小米发布 MiMo-V2.6-Pro 与 Flash 两款全模态模型,MiMo-V2.6-Pro 在 Code Arena: WebDev 榜以 1628 分(AutoEval)位列约第10名,开源权重(MIT 许可)中约第3,较 MiMo-V2.5-Pro 的 1475 分上涨 153 分。

推荐理由

榜单方第一手评测数据,给出具体分差和排名位置,可用作判断 MiMo 新版编码能力的参考。

正文 · AI 翻译

MiMo-V2.6-Pro 刚刚上线 @XiaomiMiMo,在 Code Arena:WebDev 上重返前 10,首次亮相即位列总榜约第 10 名,并在采用 MIT 许可证的开源权重模型中排名约第 3。

它拿下 1628 分(AutoEval),与 Claude Fable 5(High)持平,并略微领先 Hy4-preview(1624 分)。

相比此前的 MiMo-V2.5-Pro,这提升了 +153 分(1475 → 1628 分)。

在开源权重模型中,它位列约第 3 名。令人印象深刻的是,它仅落后 Qwen3.8 Flash Next(第 2 名)7 分,落后 Kimi K3 Max(第 1 名)46 分。

注意:这是早期的 AutoEval 分数,其中由基于 Arena 人类偏好数据训练的 Reward Model 代替实时投票进行自动投票。随着更多真人投票的加入,我们将继续观察分数如何收敛。

祝贺 @XiaomiMiMo 团队发布这一成果!

Xiaomi MiMo隆重介绍 Xiaomi MiMo-V2.6 -- Pro 与 Flash。 前沿智能,全模态,公开构建。 🔹 两款全模态模型,通过规模化强化学习不断进化 🔹 Pro 在大多数智能体基准测试中表现与 Claude Opus 5 和 GPT-5.6 Sol 相当 🔹 Pro 在 Artificial Analysis...