MiMo-V2.6-Pro 刚刚上线 @XiaomiMiMo,在 Code Arena:WebDev 上重返前 10,首次亮相即位列总榜约第 10 名,并在采用 MIT 许可证的开源权重模型中排名约第 3。
它拿下 1628 分(AutoEval),与 Claude Fable 5(High)持平,并略微领先 Hy4-preview(1624 分)。
相比此前的 MiMo-V2.5-Pro,这提升了 +153 分(1475 → 1628 分)。
在开源权重模型中,它位列约第 3 名。令人印象深刻的是,它仅落后 Qwen3.8 Flash Next(第 2 名)7 分,落后 Kimi K3 Max(第 1 名)46 分。
注意:这是早期的 AutoEval 分数,其中由基于 Arena 人类偏好数据训练的 Reward Model 代替实时投票进行自动投票。随着更多真人投票的加入,我们将继续观察分数如何收敛。
祝贺 @XiaomiMiMo 团队发布这一成果!