本周,随着 MiMo-V2.6-Pro、Claude Opus 5.5、GPT-6 Luna 和 GPT-6 Sol 的发布,智能指数与每任务成本的帕累托前沿发生了移动。
它们共同在帕累托前沿上确立了十一个新点(由不同的推理投入驱动):五个来自 GPT-6 Luna,MiMo-V2.6-Pro 和 GPT-6 Sol 各贡献一个,另有四个来自 Claude Opus 5.5。
GPT-6 Luna(max)得分为 37,每任务成本 $0.068;MiMo-V2.6-Pro 得分为 46,成本 $0.13;GPT-6 Sol(max)得分为 48,成本 $1.06;Claude Opus 5.5(max with fallback)以 58 分成为新的最高分模型,成本为 $5.98。