摘要:据Arena.ai测评,小米MiMo-V2.6-Pro在Code Arena网页开发测试场首次亮相即重返总榜前十,早期自动评估获1628分,与Claude Fable5持平。

人工智能开源生态迎来新的参与者。据Arena.ai公布的测评数据,小米旗下全模态旗舰大模型MiMo-V2.6-Pro在Code Arena: WebDev(网页开发测试场)中表现突出,首次亮相便重返总榜前十,并在采用MIT许可证的开源权重模型中高居前三。

5270b3b08531746d4417b3c70d04f85a_6392618683945784344408340.png

在评分方面,MiMo-V2.6-Pro在早期自动评估中获1628分,与Claude Fable5(High)持平,略高于得分1624分的Hy4-preview。相较上一代MiMo-V2.5-Pro的1475分,单次迭代提升了153分。在开源权重模型中,其积分仅落后排名第二的Qwen3.8Flash Next约7分,距榜首Kimi K3Max亦只有46分差距。

需要指出的是,该成绩目前由基于人类偏好数据训练的奖励模型自动投票得出。随着后续真实人类投票数据不断累积,模型最终排名仍将持续得到验证。此次MiMo-V2.6-Pro的表现,再次显示出小米在强化学习与全模态大模型研发领域的投入。