作者 | 赵芷姗
编辑 | 周伟鹏
9月22日,小米发布并开源新一代大模型MiMo-V2.6,包含Pro版和Flash版。
Pro版专攻复杂硬核任务,Flash版主打平衡性能和推理成本。
同时,小米还推出Pro的超高速变体UltraSpeed,在模型输出质量基本不变的前提下,最高可以把推理速度提升20倍,专门应对低延迟的实时调用场景。
在海外权威测评机构Artificial Analysis的综合智能指数上,MiMo-V2.6-Pro拿到46分,一举超过Kimi K3、千问3.8 Max,登顶全球开源模型第一、国产模型第一。


开源登顶
支持全模态
Pro版总参数1.02万亿,激活参数420亿,面对大型软件工程开发、3D空间推理、多模态复杂创作这类高难度工作,它能力更强。
Flash版总参数3090亿,激活参数150亿,它的推理速度快、调用成本低,更适合中小企业、个人开发者。
两个版本都支持100万Token超长上下文,一次性可以读取70多万字的文本,整本长篇小说、整套项目文档都能完整消化。
除了综合智能外,它的代码能力同样亮眼。在模拟真实软件工程的DeepSWE测试里,新一代V2.6-Pro冲到72.6分,比上一代提升14分。

这个成绩,已经和海外顶级的闭源模型Claude Opus 5(74分)、GPT-5.6 Sol(73分)站在同一梯队。
值得注意的是,Pro版和Flash版都是原生全模态模型,文字、图片、视频、音频从训练阶段就共用一套底层模型。
根据官方的技术文档,用户给它一张草图,它就能生成三维建模,可用于3D打印。

输入图片、视频或文字后,它还会拆解任务,由智能体协作完成游戏3D场景的搭建,并根据渲染结果不断修正。

但比起性能,真正让同行头皮发麻的是价格。
Pro版每百万Token输入3元,输出6元;Flash版更狠,输入只要1元,输出2元。

这还是在智能大幅升级的前提下,价格跟上一代相比,一分没涨。
综合智能比它高5分的Claude Opus 5,输入5美元(约合人民币33元),是它的11倍,输出25美元(167元),更是贵了快28倍。

罗福莉公开直播
6天烧掉2324万元
MiMo-V2.6 强大能力的背后,是小米巨大的烧钱实验。
9月17日,小米大模型团队负责人罗福莉,把MiMo-V2.6强化学习训练的实时页面对外直播。
训练步数、Token消耗量、任务通过率、累计花费,甚至哪个节点的显卡出了故障,全都实时可查。

有开发者盯着仪表板算过,半分钟费用涨了287美元,折算下来每秒约烧掉8.5美元,一小时3万美元(约合人民币20万元)。
这场直播在整个行业都是头一回,小米相当于直接把“电表”摆在所有人的面前,告诉大家:我们有钱,并且有信心,不怕被围观。
最终,这轮强化学习训练跑了不到6天,官方公布,Pro版花了262万美元,Flash版85万美元,合计347万美元,折合人民币约2324万元。
并且这些花费只是强化学习后训练的账单,不包括前面漫长昂贵的预训练。

结语
客观来说,MiMo-V2.6虽然登顶开源榜单,但和GPT-6 Astra、Claude Fable 5.1这类顶级闭源模型相比,依旧存在差距。
不过,在这条路上,不是只有一家公司在冲刺。
不久前,DeepSeek V4 Flash还因为便宜且能力强,被开发者看作是AI大模型斩杀线,现在MiMo-V2.6的推出,又重新划定斩杀线。
国产大模型开始轮番站到高处,一个比一个强,一个比一个便宜。
这早已不是单点突围,而是国产AI的集体向上。
赛道的竞争远未结束,斩杀线会不断被刷新,但这股国产AI持续突破的势头,才是最值得期待的变化。
•END•
Question. Write.Narrate. Believe. Become a story.易简传媒的愿景是提问和传播商业故事,让读者更开阔,更聪明。有 2500 万微信粉丝关注我们的账号,欢迎大家关注: