AI 快讯小米MiMo-V2.5登顶调用榜
行业快讯

小米MiMo-V2.5登顶调用榜

2026-07-27T07:02:57.067Z
小米MiMo-V2.5登顶调用榜

小米MiMo-V2.5上周调用量达到10.5万亿Token,升至OpenRouter全球榜首。中国模型包揽前五,但免费策略变化与统计口径同样左右着榜单。

小米MiMo-V2.5登顶调用榜

小米 MiMo-V2.5 在刚刚过去的一周升至全球大模型调用量第一,单周处理规模达到 10.5 万亿 Token。小米集团董事长特别助理、战略市场部副总经理徐洁云今天(7 月 27 日)公布了这一数据;按照相关统计,MiMo-V2.5 环比增长 12%,而同期全球调用量前五名全部来自中国厂商。

MiMo-V2.5 是小米面向推理、智能体和多模态任务推出的新一代基础模型系列。该系列于 2026 年 4 月 23 日开启公测,覆盖通用模型 MiMo-V2.5、增强版本 MiMo-V2.5-Pro,以及语音合成和语音识别模型 V2.5-TTS Series、V2.5-ASR,重点补强长上下文、工具使用、指令遵循、模糊意图理解和全模态感知。

2026年7月20日至26日全球大模型调用量排行榜,小米MiMo-V2.5以10.5万亿Token位居第一,中国模型包揽前五

一周10.5万亿Token,小米从第二升到第一

Token 是大模型处理文本、代码和其他序列信息时使用的基本计量单位。它不能简单等同于汉字或单词,但可以用来衡量模型实际承接的推理负载;10.5 万亿 Token 意味着 MiMo-V2.5 已经不只是被用户集中试用,而是在相当大规模的应用和智能体工作流中持续运行。

本次榜单统计周期为 2026 年 7 月 20 日至 26 日。根据《每日经济新闻》基于 OpenRouter 数据进行的测算,上周全球大模型总调用量约为 58 万亿 Token,环比下降 6.75%;其中,被统计的中国模型调用量约为 33 万亿 Token,美国模型为 2.34 万亿 Token,前者约为后者的 14.1 倍。

OpenRouter 是一个聚合多家模型并统一调用格式的模型平台,因此这份榜单反映的是其平台内可观测的开发者使用情况。严格来说,“全球调用量第一”应理解为“在 OpenRouter 统计口径下位居全球第一”,并不包含厂商自有应用、企业私有化部署、云平台直连以及消费级产品内部产生的全部 Token。

上周全球调用量前五名的具体情况如下:

| 排名 | 模型 | 厂商/地区 | 周调用量 | 环比变化 | 主要变化 | |---|---|---|---:|---:|---| | 1 | MiMo-V2.5 | 小米/中国 | 10.5 万亿 Token | +12% | 从第二升至第一 | | 2 | DeepSeek-V4-Flash | DeepSeek/中国 | 6.37 万亿 Token | +18% | 继续扩大高吞吐模型用量 | | 3 | Hy3 | 腾讯/中国 | 3.94 万亿 Token | 超过 +999% | 收费版本快速承接用户需求 | | 4 | GLM-5.2 | 智谱/中国 | 3.17 万亿 Token | -10% | 排名升至第四 | | 5 | DeepSeek-V4-Pro | DeepSeek/中国 | 3.17 万亿 Token | +17% | 首次进入前五 |

前五款模型合计处理约 27.15 万亿 Token,占同期全球统计总量的 46.8%。MiMo-V2.5 一款模型就占到约 18.1%,相当于 OpenRouter 每处理 5.5 个 Token,就有约 1 个来自 MiMo-V2.5。

小米登顶不是一次突然爆发

MiMo-V2.5 的增长轨迹显示,这次登顶是价格、产品能力和工具生态共同作用的结果。它在 5 月底首次进入主要调用榜单时,周调用量为 1.46 万亿 Token,环比增长超过 999%;6 月 15 日至 21 日,其调用量进一步升至 3.94 万亿 Token,排名第二;7 月 13 日至 19 日达到 9.19 万亿 Token,继续位居第二;最新一周则突破 10 万亿 Token。

| 统计周期 | MiMo-V2.5周调用量 | 排名 | 阶段性变化 | |---|---:|---:|---| | 5月25日—31日 | 1.46 万亿 Token | 第6 | 调价后首次进入主要榜单 | | 6月15日—21日 | 3.94 万亿 Token | 第2 | 进入第一梯队 | | 7月13日—19日 | 9.19 万亿 Token | 第2 | 环比增长55% | | 7月20日—26日 | 10.5 万亿 Token | 第1 | 环比增长12%,首次登顶 |

价格调整是 MiMo-V2.5 快速起量的第一个推动因素。小米在 5 月对 MiMo-V2.5 系列进行大幅价格调整,部分项目最高降幅达到 99%,同时不再按照上下文窗口长度区分消耗倍率;这直接降低了长文档处理、代码仓库分析和多轮智能体任务的成本不确定性。

Token Plan 是小米按统一额度管理多模型消耗的套餐体系。按照小米官方功能更新记录,MiMo-V2.5 系列在 4 月 23 日加入该体系后,256K 至 1M 上下文不再按照此前的 2 倍速度消耗额度;北京时间 0:00 至 8:00 的非高峰时段则采用 0.8 倍消耗系数。对批量跑评测、夜间生成数据或执行异步编码任务的团队来说,这种规则比单纯降低标价更容易形成稳定用量。

工具兼容是 MiMo-V2.5 快速起量的第二个推动因素。小米在 6 月 23 日增加了对 OpenAI Responses API 格式的兼容,可适配 Codex 等代码工具;更早推出的套餐体系也已面向 Claude Code、OpenCode、Cline 等主流 AI 编程工具。开发者不必重写整套工作流,就能把现有任务迁移到 MiMo,这种“低切换成本”往往比跑分领先几个百分点更能影响真实调用量。

Agent 是能够拆解任务、调用外部工具并连续执行多个步骤的人工智能系统。MiMo-V2.5 把“更稳的 Agent”列为核心卖点,意味着它瞄准的不是单轮聊天,而是代码修改、浏览器操作、数据查询和长链路任务;这类场景一次运行就可能消耗数万乃至数十万 Token,因此会比普通问答更快推高调用规模。

榜首更替也与腾讯免费版下架有关

MiMo-V2.5 本周升至第一,既有自身增长,也有上一名退出免费竞争的因素。此前连续两周排名第一的腾讯 Hy3 (free) 已从 OpenRouter 下架,其调用量环比下降 85% 至 1.76 万亿 Token,排名降至第九。

免费模型会显著改变聚合平台的调用结构。开发者通常会把批量摘要、合成数据、自动评测和低风险智能体任务优先路由给免费或极低价模型,一旦免费入口关闭,这些负载就会迅速迁移,榜单也会出现断层式变化。

腾讯 Hy3 的收费版本同时升至第三,说明免费期并非只制造了短期流量。该版本上周处理 3.94 万亿 Token,环比增长超过 999%,表明免费试用帮助腾讯完成了开发者触达,其中一部分任务在免费版退出后留在了收费模型上。

这一变化也解释了为什么全球总调用量下降,MiMo-V2.5 却能逆势增长。全球总量从前一周的 62.2 万亿 Token 降至 58 万亿 Token,减少约 4.2 万亿 Token;中国模型总量也从 36.11 万亿 Token 降至 33 万亿 Token,但 MiMo-V2.5 仍增长至 10.5 万亿 Token,市场份额因此比绝对用量上升得更快。

中国模型包揽前五,但不能只看国别胜负

中国模型连续十三周在该口径下超过美国模型,说明全球开发者对中国基础模型的采用已进入规模化阶段。更值得关注的是,当前占据前列的不只是一家公司:小米、DeepSeek、腾讯和智谱同时进入前五,竞争已经从单点爆款变成了模型组合、价格体系和开发工具生态之间的较量。

Claude 近一年来首次没有模型进入榜单前列,但这并不等于 Anthropic 的真实业务使用量突然归零。此前位列第八和第九的 Claude Opus 4.7、Claude Opus 4.8 本周双双跌出统计榜单,美国厂商只剩英伟达 Nemotron 3 Ultra (free) 一款模型上榜;然而,Claude 在官方产品、企业合同、云平台及编程工具中的直连用量并未被这份聚合平台榜单完整覆盖。

国家维度的 14.1 倍差距同样受到样本结构影响。中国厂商近几个月普遍通过免费窗口、激进降价和开放兼容接口争夺开发者,而美国头部厂商更多依赖自有入口和企业渠道;OpenRouter 对前一种分发方式的可见度天然更高,因此这项数据更适合用来观察“开放开发者市场的热度”,不适合直接推导全部大模型收入或整体市场份额。

10.5万亿Token证明了什么

10.5 万亿 Token 首先证明了小米已经进入基础模型竞争的第一梯队。小米过去在 AI 领域的优势主要来自手机、汽车和 IoT 设备形成的终端入口,而 MiMo-V2.5 的调用增长说明,它开始在独立开发者和第三方应用侧建立存在感,不再只是为小米内部产品提供底层能力。

10.5 万亿 Token 其次证明了模型竞争正在从参数规模转向单位任务成本。开发者最终关心的是完成一次代码修复、一次检索分析或一个智能体流程需要多少钱、等待多久、失败几次,而不是模型总参数有多大;小米取消长上下文额外倍率、压低价格并适配现有工具,实际上是在降低“完成任务的总成本”。

10.5 万亿 Token 还不能单独证明 MiMo-V2.5 的能力已经全球最强。调用量会同时受到价格、免费额度、路由策略、批量任务和平台推荐影响,一个便宜的模型可能处理大量简单任务,一个昂贵的模型则可能承担数量更少但价值更高的企业任务,因此调用量、收入、用户数和任务成功率必须结合观察。

开发者更应该关注三个后续指标

开发者接下来应该关注 MiMo-V2.5 在价格稳定后的留存率。模型靠降价获得首次调用并不难,真正困难的是在优惠减弱后仍然保住生产负载;如果未来数周调用量继续维持在 8 万亿至 10 万亿 Token 以上,才说明开发者已经把它放进长期路由策略。

开发者接下来也应该关注 MiMo-V2.5-Pro 与基础版本的用量结构。基础版适合高吞吐、成本敏感的工作流,Pro 版则要证明自己能在复杂代码、长链推理和多工具 Agent 中提供更高成功率;如果调用量过度集中于低价基础版,小米仍需回答高端模型商业化的问题。

开发者最后应该关注小米终端生态是否与 MiMo 平台形成闭环。小米已宣布将在 7 月 30 日举行“小米澎程”技术发布,如果后续模型能力能够进入手机、汽车、智能家居和开发者平台,并让同一套 Agent 在云端与设备端协作,MiMo 的优势将不只是价格,而是其他纯模型公司难以复制的设备入口。

结论

MiMo-V2.5 登顶的真正意义,是小米用三个月时间完成了从新模型公测到万亿级周调用的跨越。它既吃到了降价、长上下文计费优化和接口兼容带来的红利,也在腾讯免费模型退出后承接了部分市场需求。

这份第一名有含金量,但需要加上明确限定:它代表 OpenRouter 开放开发者市场中的调用规模,而不是全球所有 AI 请求的完整统计。即便如此,一款 4 月下旬才开放公测的模型,在 7 月下旬达到单周 10.5 万亿 Token,仍足以说明小米已经成为中国大模型价格战、工具生态战和 Agent 平台战中无法忽视的新变量。

参考来源

相关推荐

查看全部