小米的 MiMo,凭什么让全球开发者用脚投票?

💡 原文中文,约2100字,阅读约需5分钟。
📝

内容提要

小米MiMo-V2.5模型以单周10.5万亿Token的调用量登顶全球榜首,前六名均为中国模型。该模型由罗福莉团队主导,每36天迭代一次,投入达600亿。其优势在于高Token效率和低成本,并已嵌入小米IoT设备形成生态飞轮。尽管存在隐忧,但小米在大模型领域已展现出强劲实力。

🔎

延伸解读

Token效率:成本优势的底层逻辑

文章强调MiMo的核心竞争力在于Token效率,而非单纯参数规模。在ClawEval标准Agent任务中,MiMo-V2.5-Pro单轨迹仅用约7万Token达到64%通过率,而Claude Opus 4.6和GPT-5.4普遍需要12到18万Token,同等效果下成本节省40%到60%。这一优势直接转化为价格竞争力,5月27日小米对V2.5系列永久降价,最高降幅99%,Pro版输入仅3元/百万Token,远低于OpenAI和Anthropic的美元计价。对于B端开发者而言,Token成本是实际支出,效率提升意味着

终端生态:小米的独特护城河

小米拥有全球超过10亿台IoT设备,MiMo的端侧模型可直接在手机、汽车上运行,高频任务本地处理,复杂任务云端完成。这种“模型越强→终端越好→数据越多→迭代越快”的飞轮效应,是纯AI公司难以复制的。与百度、阿里、字节等走场景化路线不同,小米选择终端原生智能体,将模型嵌入操作系统,使AI成为设备的一部分。这一策略虽然难度更高,但护城河更深,因为终端设备提供了天然的数据采集和应用场景,形成闭环。

迭代速度与隐忧:36天周期的可持续性

小米MiMo以36天一次的迭代速度远超行业常规的8到12个月,这得益于雷军承诺的三年600亿AI投入和年轻团队的高效执行。然而,这种高速迭代是否可持续值得关注。文章指出,与Claude的追赶仍存在差距,开源后的商业化路径也不明朗。高速迭代可能带来技术债务和资源压力,长期来看,如何平衡速度与稳定性,将是小米需要面对的挑战。

Q&A

小米MiMo-V2.5模型在2026年7月的全球调用量排名如何?

根据OpenRouter公布的2026年7月月度调用量排行榜,小米MiMo-V2.5登顶全球第一,单周调用量达到10.5万亿Token,两个月增长616%,且前六名均为中国模型。

小米MiMo模型的主要负责人是谁?她有什么背景?

小米MiMo模型的主要负责人是罗福莉,95后,四川宜宾人,北大硕士,曾是DeepSeek-V2的核心开发者。2024年底被雷军以千万年薪挖到小米,2025年11月正式出任MiMo大模型负责人。

小米MiMo模型的迭代速度有多快?正常行业节奏是多少?

小米MiMo模型从2025年12月开源到2026年4月发布V2.5系列,每36天迭代一次,而正常行业节奏是8到12个月,小米将周期缩短到了十分之一。

小米MiMo在Token效率方面有什么优势?

在ClawEval标准Agent任务中,MiMo-V2.5-Pro单轨迹只用约7万Token达到64%通过率,而Claude Opus 4.6和GPT-5.4普遍需要12到18万Token,同样效果下节省了40%到60%的成本。

小米MiMo模型在价格上有什么调整?

2026年5月27日,小米对V2.5系列进行了永久性降价,最高降幅达99%。现在Pro版输入仅3元/百万Token,而OpenAI和Anthropic旗舰模型以美元计价且价格数倍于此。

小米MiMo如何利用其IoT设备生态?

小米在全球有超过10亿台IoT设备,MiMo的端侧模型能直接在手机、汽车上运行,高频任务本地处理,复杂任务云端解决。这形成了“模型越强→终端越好→数据越多→迭代越快”的飞轮,纯AI公司不具备。

小米在大模型领域的打法与其他公司有何不同?

小米走的是终端原生智能体路线,将模型嵌入操作系统,让AI成为设备的一部分。而百度走搜索增强,阿里走电商场景,字节走内容分发。小米的路线更难,但护城河更深。

小米MiMo模型存在哪些隐忧?

小米MiMo的隐忧包括:36天一迭代不可持续,与Claude的追赶还差一口气,开源后的商业化路径不明朗。

🏷️

标签

➡️

继续阅读