一个”不务正业”的手机厂商,怎么就在AI模型调用量上干翻了所有人?
2026年7月,OpenRouter——全球最大的AI模型API聚合平台——的月度排行榜上,一个很多人没想到的名字稳居第一:小米。
不是OpenAI,不是Anthropic,不是Google,是那个做手机、做空调、做电车的小米。
更让人意外的是,小米的MiMo系列模型从上线到登顶,只用了不到三个月。
一、先看数据:MiMo的登顶之路
让我们用一张时间线来还原这个过程:
| 时间 | 事件 | OpenRouter排名 |
|---|
|——|——|—————|
| 2025年底 | MiMo-V2-Flash(free)上线 | 新晋上榜,快速上升 |
|---|---|---|
| 2026年1月 | Flash版本持续放量 | 周调用量约582B Tokens,总榜前列 |
| 2026年3月18日 | MiMo-V2-Pro上线 | 上线即引爆 |
| 2026年3月31日 | 小米官方汇报成绩 | 日榜/周榜/月榜三冠王 |
| 2026年4月22日 | MiMo-V2.5上线 | Pro级性能,半价成本 |
| 2026年5月底 | V2.5系列大幅降价(最高99%) | 两款同时冲榜 |
| 2026年6月 | 全球周调用量31.8万亿Token | 连续六周上涨 |
3月31日的数据最为惊人:MiMo-V2-Pro上线不到半个月,累计Token消耗量超6万亿,最近一周突破4万亿,同时拿下日榜、周榜、月榜三个第一。
二、为什么是小米?五个关键原因
原因一:免费策略——用”零门槛”撕开市场缺口
小米做的第一件事,就是把MiMo-V2-Flash设为免费。
这在当时看起来像个”傻子行为”——你辛辛苦苦训出来的模型,白给人用?
但小米很清楚:在OpenRouter这样的平台上,开发者选模型的第一反应不是”哪个最强”,而是”哪个能先跑起来”。免费意味着零试错成本,一个开发者只要试过一次MiMo,就有可能留下来。
事实证明这招极其有效。MiMo-V2-Flash上线后,调用量像坐火箭一样往上蹿。免费模型的调用量天然比付费模型高几个数量级,而OpenRouter的排行榜恰恰是按Token消耗量排的。
小米用免费模型把”调用量”这个指标打到了天花板。
原因二:Agent能力——踩中了2026年最大的技术风口
2026年AI行业最大的变化是什么?不是聊天机器人更强了,而是AI Agent(智能体)全面落地了。
从代码编写到数据分析,从自动化运维到智能客服,Agent场景需要模型具备三个核心能力:
- 长上下文理解:一次处理大量信息
- 工具调用稳定:准确地调用API、执行代码
- 多步推理:把复杂任务拆解成步骤逐一完成
小米的MiMo系列从一开始就是冲着Agent场景优化的。MiMo-V2-Pro拥有100万Token上下文窗口和超过1万亿参数,在ClawEval、GDPVal、SWE-bench Pro等Agent评测榜单上名列前茅。
OpenRouter的博客文章明确指出:Agentic工作loads是驱动Token消耗量飙升的核心动力。而小米恰好在这个赛道上押对了注。
原因三:极致性价比——”地板价”推理成本
免费版拉来用户,但真正让小米持续霸榜的,是极致的性价比。
来看一组对比:
| 模型 | 输入价格(每百万Token) | 输出价格(每百万Token) |
|---|
|——|———————-|———————-|
| MiMo-V2-Pro | $0.348 | $0.696 |
|---|---|---|
| MiMo-V2.5 | $0.112 | $0.224 |
| Claude Opus 4.6 | ~$15 | ~$75 |
| GPT-5.5 | ~$10 | ~$30 |
MiMo-V2-Pro的价格大约是Claude Opus的2.5%。
这意味着什么?一个开发者用Claude跑Agent一天花100美元,用MiMo只需要2.5美元。对于需要大量调用的企业级Agent场景,这个成本差距是决定性的。
5月底小米更是把MiMo-V2.5系列降价最高99%,并且不再区分上下文窗口长度。这种”卷到极致”的定价策略,直接把调用量推上了新高度。
原因四:开源生态——让全世界开发者帮你建护城河
小米在开源方面做得非常彻底。MiMo系列不仅模型权重开放,还提供了完整的工具链和文档。
开源带来的好处是双重的:
第一,开发者信任度高。 开源模型可以本地部署、可以微调、可以审计,企业用起来没有”被锁定”的顾虑。
第二,社区贡献反哺模型。 开发者在使用过程中发现问题、提出改进、分享最佳实践,这些反馈让模型迭代更快。
小米还积极拥抱主流Agent框架(如OpenClaw),让MiMo能无缝集成到开发者的现有工作流中。这种”生态友好”的策略,让MiMo的采用速度远超闭源竞品。
原因五:小米的”全栈”优势——从手机到云端的完整链条
小米不是一般的创业公司,它是一个拥有手机、IoT、汽车、云服务全链条的科技巨头。
这意味着:
- 海量真实用户数据:小米手机、小爱同学、米家设备产生的交互数据,是训练Agent能力的天然燃料
- 硬件协同:MiMo可以跑在小米手机、小米汽车、小米智能家居上,形成”端云协同”的独特优势
- 资金实力:雷军宣布未来三年在AI领域投入600亿元,这种投入力度在手机厂商中绝无仅有
小米MiMo的官方介绍页面明确写着:MiMo-V2-Pro在Artificial Analysis Intelligence Index全球排名第8、中国大模型排名第2。
这不是一个”玩票”的项目,而是小米all-in AI的战略级产品。
三、对行业意味着什么?
1. 模型定价逻辑被彻底改写
小米证明了一件事:在AI模型市场,”便宜”本身就是一种核心竞争力。
当所有厂商都在比拼”谁更强”的时候,小米用”谁更便宜”杀出了一条血路。这迫使所有模型厂商重新思考定价策略——你不降价,用户就跑去用MiMo了。
2. Agent场景成为主战场
OpenRouter的数据清楚地表明:Token消耗量的最大驱动力已经从”聊天”转向了”Agent”。
一个聊天对话可能只需要几千Token,但一个Agent任务可能消耗几百万甚至几千万Token。小米在Agent能力上的投入,直接转化为了调用量上的碾压优势。
3. 中国AI的”群体突围”
小米的登顶不是孤例。在OpenRouter的排行榜上,DeepSeek、Qwen等中国模型同样表现强劲。
根据每日经济新闻的报道,2026年5月最后一周,全球AI大模型总调用量达到31.8万亿Token,其中中国模型占据了相当大的份额。
中国AI正在从”追赶者”变成”领跑者”,而小米MiMo是这个趋势中最耀眼的代表。
四、小米的隐忧:低价能持续多久?
当然,小米的策略也面临挑战。
第一,盈利能力存疑。 当价格降到”地板价”时,每调用一次可能都在亏钱。小米能否通过规模效应降低成本,或者找到其他盈利模式(如企业版增值服务),是关键问题。
第二,模型能力天花板。 在Text Arena等”纯智力”评测中,MiMo-V2-Pro排名全球前五,但仍落后于Anthropic和OpenAI的顶级模型。低价能吸引用户,但长期留住用户靠的是能力。
第三,竞争对手不会坐以待毙。 OpenAI、Anthropic、Google都在降价,DeepSeek同样以低价著称。小米的价格优势可能被逐渐蚕食。
五、结语:技术平权的中国样本
小米MiMo登顶OpenRouter,本质上是一个“技术平权”的故事。
当AI模型的价格降到几乎免费,当一个手机厂商的开源模型能和全球顶尖公司同台竞技,当100万Token上下文不再是少数公司的专利——AI的普惠化就真的到来了。
雷军说”未来三年在AI领域投入600亿元”。小米用MiMo证明了,这笔钱花得值。
而对于全球开发者来说,OpenRouter排行榜的变化传递了一个清晰的信号:选模型,不一定要选最贵的,要选最适合的。
小米MiMo,恰好在正确的时间、正确的平台、用正确的价格,提供了正确的能力。
*数据来源:OpenRouter官方排行榜、IT之家、每日经济新闻、小米技术官方微博、雪球*
*分析时间:2026年7月*
发表回复