小米 MiMo-V2.6-Pro 登上 Code Arena: WebDev 榜约第10名,开源权重中约第3
MiMo-V2.6-Pro just landed @XiaomiMiMo back in the top 10 on Code Arena: WebDev, debuting at ~#10 ove…
精选理由
榜单方第一手评测数据,给出具体分差和排名位置,可用作判断 MiMo 新版编码能力的参考。
AI 摘要
小米发布 MiMo-V2.6-Pro 与 Flash 两款全模态模型,MiMo-V2.6-Pro 在 Code Arena: WebDev 榜以 1628 分(AutoEval)位列约第10名,开源权重(MIT 许可)中约第3,较 MiMo-V2.5-Pro 的 1475 分上涨 153 分。
正文 · AI 翻译
MiMo-V2.6-Pro 刚刚上线 @XiaomiMiMo,在 Code Arena:WebDev 上重返前 10,首次亮相即位列总榜约第 10 名,并在采用 MIT 许可证的开源权重模型中排名约第 3。
它拿下 1628 分(AutoEval),与 Claude Fable 5(High)持平,并略微领先 Hy4-preview(1624 分)。
相比此前的 MiMo-V2.5-Pro,这提升了 +153 分(1475 → 1628 分)。
在开源权重模型中,它位列约第 3 名。令人印象深刻的是,它仅落后 Qwen3.8 Flash Next(第 2 名)7 分,落后 Kimi K3 Max(第 1 名)46 分。
注意:这是早期的 AutoEval 分数,其中由基于 Arena 人类偏好数据训练的 Reward Model 代替实时投票进行自动投票。随着更多真人投票的加入,我们将继续观察分数如何收敛。
祝贺 @XiaomiMiMo 团队发布这一成果!
### 引用推文
> Xiaomi MiMo:隆重介绍 Xiaomi MiMo-V2.6 -- Pro 与 Flash。 前沿智能,全模态,公开构建。 🔹 两款全模态模型,通过规模化强化学习不断进化 🔹 Pro 在大多数智能体基准测试中表现与 Claude Opus 5 和 GPT-5.6 Sol 相当 🔹 Pro 在 Artificial Analysis...
原文
Original Title
MiMo-V2.6-Pro just landed @XiaomiMiMo back in the top 10 on Code Arena: WebDev, debuting at ~#10 ove…
Source
Arena.ai (@arena)
Site
x.com
Published
2026-09-22 05:08