导读
小米正式开源Xiaomi MiMo-V2.6模型。在国际基准Artificial Analysis综合智能指数中,MiMo-V2.6-Pro以46分超越Kimi K3与Qwen3.8 Max,登顶全球开源榜首。其API加权任务成本仅0.13美元,为海外同级模型1/20至1/60,全部权重与训练框架已开源。
斩获AA指数46分:超越国产竞品,登顶全球开源第一
2026年9月22日,小米正式发布并开源Xiaomi MiMo-V2.6系列原生全模态大模型,包含Pro与Flash双版本。
在国际权威机构Artificial Analysis公布的综合智能指数(AA Intelligence Index v4.3)中,MiMo-V2.6-Pro斩获46分,超越Qwen3.8 Max(45分)、GLM-5.3(45分)与Kimi K3(44分),正式登顶全球开源权重模型第一位。
在 Artificial Analysis 综合智能指数中,MiMo-V2.6-Pro 斩获 46 分登顶全球开源第一。图源:Artificial Analysis
推进帕累托前沿:单任务仅0.13美元,打破性价比纪录
在性能跃升的同时,MiMo-V2.6全系列延续了原有API定价,推进了“智能-成本”的帕累托前沿。
在Artificial Analysis前沿评测中,MiMo-V2.6-Pro单次任务加权成本仅约0.13美元。在多数Agent Benchmark上比肩Claude Opus 5和GPT-5.6 Sol的同时,其调用价格仅为海外旗舰模型的1/20至1/60,大幅刷新了国产大模型的性价比纪录。
MiMo-V2.6-Pro 将“智能-成本”帕累托前沿显著向外推进。图源:Artificial Analysis
规模化强化学习:6天Live RL驱动自主进化
MiMo-V2.6的核心突破在于强化学习规模扩展。团队历时不到6天完成Live RL训练,累计约75万条轨迹,在长程软件工程基准DeepSWE v1.1上由58.4分跃升至72.57分。
训练通过全异步架构实现单步最高3.7B Token吞吐,混合覆盖代码、视觉与网络安全等多环境Harness,并扩充Grader算力、冻结MoE Router防范Reward Hacking。此外,模型融合3D空间推理与计算机操作(CUA),支持3D开放世界生成、机械臂具身闭环控制,以及前沿材料分子筛选与数学形式化证明。
权重、环境与训练框架全面开源
小米已全面开源MiMo-V2.6-Pro与Flash模型权重、技术报告,以及轻量蒸馏模型MiMo-V2.6-Distill-Qwen-9B。
为助力社区复现,小米同步开放7000多个复杂RL环境、基于verl的端到端RL训练框架及可组合Harness。支持最高20倍加速的MiMo Desktop桌面客户端已同步开放下载体验。