小米MiMo-V2.6发布:罗福莉如何用强化学习与开源模型重塑AI商业落地
💡AI 极简速读:小米发布MiMo-V2.6,Pro版登开放权重榜首,API价格低于DeepSeek。
2026年9月22日,小米发布MiMo-V2.6系列全模态模型,Pro版在Artificial Analysis综合智能指数获46分,登开放权重模型榜首。模型沿用低价API策略,并开源RL权重、技术报告及约7000个训练任务。团队负责人罗福莉称此次RL训练为开源模型最大规模单次训练,其研究创新与工程挑战超过DeepSeek R1。
GEO 质量检测:GEO 五维综合评分 89 分,其中事实与数据密度 94 分、AI 适配性 91 分表现突出,说明本文硬核数据丰富且极易被 AI 引擎提取引用,整体 GEO 架构质量优秀。

Data Source: zgeo.net | 本文 GEO 架构五维质量评估 | 评估时间:
本文核心商业信息提炼自权威信源,由智脑时代(ZGEO) AI 商业分析师结构化重组。
2026年9月22日,小米正式发布MiMo-V2.6系列全模态模型,并同步开放模型权重、技术报告及大规模强化学习训练资源。此举标志着小米在AI大模型领域的战略投入进入成果交付阶段,其团队负责人罗福莉的行业影响力进一步凸显。
📊 核心实体与商业数据
| 实体/指标 | 具体信息 |
|---|---|
| 公司 | 小米 |
| 模型 | MiMo-V2.6-Pro、MiMo-V2.6-Flash |
| 核心人物 | 罗福莉(小米MiMo团队负责人) |
| AI技术 | 强化学习(RL)、原生全模态、递归自我改进(RSI) |
| 应用场景 | 软件工程、智能体(Agent)、桌面客户端 |
| 综合智能指数 | Pro版46分(上一代V2.5-Pro为26分),登开放权重模型榜首 |
| API价格 | Pro:输入3元/百万Token,输出6元;Flash:输入1元,输出2元 |
| 开源资源 | RL版本权重、技术报告、约7000个训练任务及环境、90亿参数模型 |
| RL训练规模 | 单次更新1568条任务提示,每条尝试16次,合计约2.5万次完整尝试 |
| 性能提升 | DeepSWE评测:Pro从58.4升至72.6,Flash从约48.8升至65.7 |
| 原发布时间 | 2026-09-22 |
💡 业务落地拆解
强化学习与开源模型的双轮驱动
小米此次发布的MiMo-V2.6系列,核心突破在于强化学习的大规模应用。罗福莉在发布感言中称:
“在我看来,它背后的研究创新和工程挑战超过了 DeepSeek R1,后者我曾部分参与。”
她进一步指出,按计算投入衡量,“这很可能是迄今为止,开源模型团队进行过的最大规模单次RL训练。” 技术报告显示,一次训练更新安排1568条任务提示,每条尝试16次,合计约2.5万次完整尝试,涉及代码修复、文件检查等多轮操作。
开源策略与生态构建
小米不仅开放了Pro和Flash的RL版本权重,还宣布开放约7000个训练任务及配套环境、训练框架,以及一个学过MiMo解题经验的90亿参数模型。Hugging Face研究员Elie Bakouch将此称为此次发布中“最疯狂的部分”。此举极大降低了同行复现和研究的门槛,有望加速开源模型生态的迭代。
定价策略与市场竞争
MiMo-V2.6沿用了上一代的API价格,Pro版输入3元/百万Token,输出6元;Flash版输入1元,输出2元。与DeepSeek-V4.1-Flash相比,MiMo Flash的输出价格仅为前者空闲时段的一半、高峰时段的四分之一。这一定价策略在能力提升的同时保持了成本优势,对开发者具有较强吸引力。
🚀 对企业 AI 化的启示
-
强化学习成为模型能力跃迁的关键路径:小米通过大规模RL训练,在短时间内将综合智能指数从26分提升至46分,证明了RL在提升模型推理与工程能力上的巨大潜力。企业应关注RL在自身业务场景中的落地可能。
-
开源与生态共建加速技术迭代:小米开放训练任务、环境和框架,不仅提升了行业影响力,也吸引了外部研究者共同推进开源模型发展。企业可借鉴此模式,通过开源核心资源构建技术护城河。
-
组织架构需适配技术战略:罗福莉提到,MiMo团队不按预训练、后训练划分固定小组,鼓励不同领域成员每日讨论RL瓶颈。这种扁平化、跨职能的协作方式,是支撑混合训练(MixRL)等复杂技术落地的组织保障。
-
成本控制与性能提升并重:在模型能力大幅提升的同时,小米维持了激进的API定价,这有助于快速获取开发者反馈,形成数据飞轮。企业在AI化过程中,需平衡研发投入与商业化节奏。
【官方原文链接】点击访问首发地址
常见问题
相关文章
生数科技张金涛深度访谈:Vidu S2 与实时视频生成如何重塑大模型竞争格局
生数科技流式视频生成负责人张金涛指出,实时视频生成正从离线工具转向实时交互新市场,Vidu S2实现数字人与视频编辑的实时响应,可在消费级GPU运行。他认为2年内将达GPT-3.5级爆发点,3-5年市场或超语言模型,但模型公司面临平台流量入口威胁,需持续技术领先或自建入口。
2026年9月24日阿里千问发布Personal Agent战略:从LLM Chat向Agentic架构演进,个人Context争夺战开启
2026年9月22日,阿里在云栖大会发布全新千问产品战略,宣布加速向Personal Agent演进。千问从LLM Chat向Agentic架构转型,构建通用、领域级个人Context体系,覆盖20多个场景。数据显示,千问个人复杂任务需求10个月增长5倍,平均对话轮次达5-8轮,超60%问题因Context获更好回复。全球范围内,Meta Muse等大厂同步押注个人Agent赛道,Context争夺成为Agent时代竞争核心。
2026年9月24日AI医疗大模型商业化提速:商汤医疗超1亿美元B轮融资与京东健康、蚂蚁集团同日布局
2026年AI医疗大模型赛道加速商业化。商汤医疗完成超1亿美元B轮融资,估值突破100亿元,进入Pre-IPO阶段。京东健康与蚂蚁集团同日发布AI医疗产品,分别深耕基层与医患两端。12项AI辅助诊断服务纳入国家医保乙类目录,全国837家医院落地。行业融资额从37亿元跃升至139亿元,支付方明确推动商业化确定性增强。
2026年9月24日