原创小米MiMo-V2.6-Pro强势回归Code Arena前十,性能直逼国际第一梯队
人工智能开源生态迎来又一强劲选手。Arena.ai 公布最新测评数据,小米全新全模态旗舰大模型 MiMo-V2.6-Pro 登陆 Code Arena: WebDev 网页开发测试场,首次参评便冲进总榜前十,在 MIT 许可证开源权重模型里位居前三,展现不俗的代码开发能力。
一、测评分数大幅提升,对标多款头部模型
AutoEval 自动评估环节,MiMo-V2.6-Pro 斩获 1628 分。该成绩与 Claude Fable5 (High) 持平,略高于 Hy4-preview 的 1624 分。对比上一代 MiMo-V2.5-Pro 的 1475 分,单次迭代分数大涨 153 分,性能进步十分显著。
二、横向对标开源竞品,紧追榜单头部选手
横向对比开源权重模型,MiMo-V2.6-Pro 表现亮眼。当前积分距离第二名 Qwen3.8Flash Next 仅相差 7 分,距离榜首 Kimi K3Max 仅有 46 分差距,已经逼近开源模型第一梯队。