小米发布 MiMo-V2.6 Pro 与 Flash 全模态开源模型

发布时间: 2026-09-22 文章分类: AI前沿技术
阅读量: 0
AI智能体
企业级AI智能体开发与部署
LumeValley提供全栈式企业级AI智能体开发与部署服务,涵盖战略规划、场景化开发、企业级应用构建、行业解决方案及算力支撑。从需求分析到持续优化,确保智能体高效稳定运行,助力企业实现智能化转型,提升运营效率与竞争力。

46 分。放在 Artificial Analysis 智能指数那张表上,这个数字把开源权重的天花板又往上顶了一截。小米 MiMo 这次一口气放出 MiMo-V2.6 Pro 和 MiMo-V2.6 Flash,两个都是全模态模型,训练路线写得毫不含糊——规模化强化学习。Pro 在大多数 Agent 基准上跟 Claude Opus 5、GPT-5.6 Sol 打得有来有回,而那两位是闭源阵营里最贵的选手。更值得琢磨的是另一件事:权重、技术报告、训练代码,一起交了。

46 分到底是什么位置

一个指数,三种参照系

Artificial Analysis 的智能指数不是一个单科成绩。它把推理、知识、编码、指令遵循这些维度揉在一起,最后压成一个数字。46 分之所以被反复提起,是因为它同时成立在三个参照系里:跟自家上一代比是跳变,跟同尺寸开源模型比是领先,跟闭源头部比是——够得着了。开源模型过去习惯在某个细分榜单上刷一次存在感,然后被综合榜打回原形。这次不太一样,Pro 拿的是综合位次,而且是最高的那个开源位次。

天花板被抬走之后

开源社区对"最强开源"这四个字已经有点免疫了,几乎每个月都有人宣布。但真正稀缺的不是称号,是可复现的路径。MiMo 这次把训练代码和技术报告一并放出,等于把梯子搭在了墙外。别人可以沿着同一条路走第二遍、第三遍,也可以在中途岔出去。开源生态的推进方式从来不是某一家跑得多快,而是有多少人踩着你的脚印继续往前。

被压缩的追赶窗口

闭源模型领先开源的时间差,过去通常以半年计。现在这个窗口正在被压缩到几个月甚至更短。46 分本身不吓人,吓人的是它出现在一个开放权重的模型上。当前沿能力可以在几周内被下载、微调、私有化部署,模型厂商卖的东西就得重新想一遍了——是卖能力,还是卖确定性、合规和运维。

Pro 和 Flash,同一套配方两种火候

Pro 冲的是 Agent 主战场

Pro 的定位很明确:去干那些需要连续决策、多步执行、跟外部工具打交道的活。Agent 基准测的从来不是"你能不能答对",而是"你能不能自己把事办完"。多轮调用、错误恢复、上下文管理、什么时候该停下来问人——这些都不在传统 benchmark 的考察范围里,却决定了模型能不能真的被塞进工作流。Pro 在这个维度上贴着 Claude Opus 5 和 GPT-5.6 Sol,说明它在"办事"这件事上已经拿到了入场券。

Flash 才是被低估的那一半

发布稿里 Flash 通常一句话带过,读者也习惯性略过。但真正跑量的永远是便宜的那个。一个全模态模型如果只能待在实验室里按 token 计价,它对产业的改变是有限的;只有当它有足够低成本的孪生兄弟,能力才会渗进客服、巡检、内容审核、教育这些毛利本就不高的场景。Flash 的意义不在分数,在单价。

规模化强化学习放大了什么

这两年强化学习被反复重提,但"规模化"三个字才是关键变量。小规模 RL 调出来的是偏好,大规模 RL 调出来的更接近策略——模型开始知道在什么情况下该换工具,什么时候该重试,什么时候该承认自己不知道。这类行为很难靠监督微调教出来,只能靠足够多的环境、足够长的 rollout 和足够狠的奖励设计磨出来。小米 MiMo 把这条路线明确写在发布信息里,等于承认了算力账本的分量。

编码、computer use、3D 推理挤在一个模型里

从写代码到点鼠标

编码能力是当前模型的硬通货,这点没有争议。争议在于 computer use——让模型看着屏幕截图,理解界面,然后决定点哪里、输什么、滚多少。这个任务对模型的考验是复合的:视觉定位、界面语义、时序规划、失败重试,缺一块就卡死。它跟写代码共用同一套底层能力,这才是小米把两者放进同一个模型的原因。能写函数的人未必会用软件,但会用软件的人通常能更快学会写函数。

3D 推理不是炫技

全模态里最容易被当噱头的是 3D。空间关系、遮挡、视角变换、几何一致性——这些能力在纯文本模型上几乎无处安放。但它们直接对应机器人、自动驾驶、工业质检、AR 交互这些场景。把 3D 推理做进通用模型,意味着未来做具身智能的团队不必再从零训练一个空间理解模块,直接调用底座就行。这是基础设施层面的事,不是 demo 层面的事。

模态越多,代价越贵

没人能白拿多模态。视觉 token 的膨胀、跨模态对齐的复杂度、不同任务之间的梯度冲突,都会反映在训练成本和推理延迟上。Pro 和 Flash 的分野,本质上就是对这份代价的两种分摊方式:一个扛住峰值能力,一个把单位成本压下去。用户按场景选,厂商按算力算。

权重、报告、代码,一起放出来图什么

开源不是姿态,是分发渠道

大厂开源模型从来不是纯粹的公益。权重放出去,模型就会被部署到那些厂商自己销售团队覆盖不到的中小企业、海外市场、垂直行业里。这些场景不会给官方 API 贡献多少收入,但它们会贡献使用习惯、反馈数据和生态位。等到下一轮采购决策时,这些默认选项会自己浮上来。小米在硬件上干过一模一样的事,只是这次换成了模型权重。

跟 Opus 5、GPT-5.6 Sol 的对位说明了什么

把对比对象直接写成 Claude Opus 5 和 GPT-5.6 Sol,是很有信息量的一步棋。它等于公开宣布:我不跟开源同行比了,我进第一梯队的桌子。这类对位当然有选择性展示的成分——挑对自己有利的基准,谁也不例外。但 Agent 基准本身很难美化,多轮执行的成绩骗不了人。能在这些benchmark上维持接近,就已经不是"国产模型进步很快"这种模糊表述能概括的了。

下一轮竞争的入场券

模型能力的差距在收窄,这件事对所有人都是压力。闭源厂商要证明自己值那份溢价,开源阵营要证明自己能持续跟进而不是一次性爆发,中间层要证明自己不可替代。全模态规模化强化学习开放权重,这三个词凑在一起,是小米 MiMo 给自己买的入场券——能坐到哪一桌,还得看下一次发布时,那个指数上的数字是往上走还是原地不动。

AI智能体
企业级AI智能体开发与部署方案
LumeValley打造企业级AI智能体全流程方案,涵盖需求洞察、定制开发、多平台适配部署。凭借专业算法与丰富经验,确保智能体精准理解业务,高效执行任务,无缝融入企业生态,为企业数字化转型提供强劲智能引擎,提升核心竞争力。
点赞 | 98

Lumevalley——全栈AI服务领航者,以“战略-应用-算力”三位一体服务框架,为企业提供从顶层战略规划、场景化AI智能体(AI Agent)开发/搭建/部署,到企业级AI应用开发、AI+行业场景解决方案的全链路服务,并配套AI大模型部署与高性能AI算力底座支撑,助力客户在营销、服务、运营等核心环节实现效率倍增与模式创新。

马上扫码获取产品资料
相关文章

相关文章

填写以下信息, 免费获取方案报价
姓名
手机号码
企业名称
  • 建筑建材
  • 化工
  • 钢铁
  • 机械设备
  • 原材料
  • 工业
  • 环保
  • 生鲜
  • 医疗
  • 快消品
  • 农林牧渔
  • 汽车汽配
  • 橡胶
  • 工程
  • 加工
  • 仪器仪表
  • 纺织
  • 服装
  • 电子元器件
  • 物流
  • 化塑
  • 食品
  • 房地产
  • 交通运输
  • 能源
  • 印刷
  • 教育
  • 跨境电商
  • 旅游
  • 皮革
  • 3C数码
  • 金属制品
  • 批发
  • 研究和发展
  • 其他行业
需求描述
填写以下信息马上为您安排系统演示
姓名
手机号码
你的职位
企业名称

恭喜您的需求提交成功

尊敬的用户,您好!

您的需求我们已经收到,我们会为您安排专属电商商务顾问在24小时内(工作日时间)内与您取得联系,请您在此期间保持电话畅通,并且注意接听来自广州区域的来电。
感谢您的支持!

您好,我是您的专属产品顾问
扫码添加我的微信,免费体验系统
(工作日09:00 - 18:00)
电话咨询 (工作日09:00 - 18:00)
客服热线: 18011747352
售前热线: 189 2432 2993
扫码即可快速拨打热线