凤凰网科技讯 9月22日,小米正式发布并开源Xiaomi MiMo-V2.6系列,包含Pro与Flash两个原生全模态模型。官方称这是其探索RSI(递归自我改进)路径的关键一步,通过规模化扩展强化学习算力,让模型在持续探索与反馈中拓展智能边界。
跑分方面,MiMo-V2.6-Pro在Artificial Analysis综合智能指数中取得46分,超过Kimi K3和Qwen3.8 Max,成为当前最强开源模型,但与Claude Fable 5.1、GPT-6 Astra等闭源旗舰仍有差距。定价沿用V2.5系列,同等智能水平下价格仅为海外模型的1/20至1/60。
RL训练方面,MiMo-V2.6可能是目前国产开源模型中投入RL算力最多的模型之一。Pro与Flash训练历时不到6天,成本分别约262万美元与85万美元,各完成30步,累计约75万条轨迹。训练任务平均通过率分别提升25%和12%;在长程软件工程评测DeepSWE v1.1中,Pro从58.4提升至72.57,Flash从48.8提升至65.68。训练采用1568个样本的大Batch、支持1M上下文,单步训练Token达2.7至3.7B。
能力扩展上,MiMo-V2.6融合3D空间推理、多模态感知与计算机操作能力,可从自然语言生成3D开放世界游戏、在Blender中完成建模,并控制机械臂完成抓取任务。科研方面,模型协助完成MOF材料设计筛选及Lean 4中Li-Yorke定理的完整形式化,形成6000余行源码。设计评测Design Arena上,MiMo-V2.6-Pro达到与Claude Opus 5、GPT-5.6 Sol相近水平。
使用与开源,MiMo Desktop桌面客户端及会员订阅同步上线,Pro提供UltraSpeed超高速模式,最高20倍输出速度。API价格维持不变。小米全面开源Pro、Flash模型权重、技术报告,并开放MiMo-V2.6-Distill-Qwen-9B及7k+高质量RL任务环境、端到端RL训练框架等资源。