中国AI大模型调用量连续19周居首,环比增长37%
据《每日经济新闻》援引OpenRouter平台近期披露的数据统计显示,8月31日至9月6日这一周内,全球各类AI大模型的累计调用规模达到115万亿Token,较前一周微增1.77%。
分国家来看,入选榜单的中国AI大模型当周合计调用量为56.72万亿Token,环比上升2.83%;而同一时期美国AI大模型的周调用量为16.54万亿Token,环比下降3.1%。这意味着中国大模型的周度调用总量已连续第十九周领先美国,持续占据全球第一的位置。

报道同时指出,在全球调用量TOP 5中,有四个席位被中国AI大模型占据。位列榜首的是腾讯混元Hy4 preview,单周调用量高达14.7万亿Token,环比增幅达379%。

该模型于8月28日正式上线并完成开源,整体参数量为770B,激活参数为49B,上下文窗口突破1M token,主要围绕Agent智能体、代码编写及办公生产力等应用场景进行了深度调优,旨在提升其在实际业务环境中处理复杂任务的水平。
9月1日,腾讯混元团队进一步发布了Hy4 preview的轻量化版本,将模型权重体积由原先的1.5TB大幅缩减至约214GB,显著降低了本地化部署的硬件要求。官方表示,经过压缩后,模型在长文本理解方面的表现与原版几乎无异,多轮长上下文的检索精度也基本维持在同等水准。
排名第二的是GPT-5.6 Luna,周调用量为12.9万亿Token,环比上涨66%;智谱GLM-5.3 Flash攀升至第三位,周调用量12.4万亿Token,环比翻倍增长101%;DeepSeek-V4-Flash-0731(即DeepSeek-V4-Flash正式发布版)位列第四,周调用量同为12.4万亿Token;DeepSeek-V4-Flash-0423(即DeepSeek-V4-Flash预览版)排在第五,周调用量为5.19万亿Token。
距离上次亮相接近一个月后,MiniMax M3再度回归榜单,排名第第六位,周调用量录得5.02万亿Token,环比增长95%。此前MiniMax曾公告,自8月24日起至9月6日,开发者可在GMI Cloud及OpenRouter平台上免费体验包括MiniMax M3在内的多款模型。
MiniMax M3于今年6月发布并同步开源,定位为面向代码开发、智能体及原生多模态交互场景的旗舰级模型。该模型在训练阶段便采用文本、图像与视频的多模态联合训练策略,并支持百万Token级别的超长上下文处理。
另外值得关注的是,上周沙特主权财富基金——公共投资基金(PIF)旗下的AI企业HUMAIN正式推出了其首款阿拉伯语大模型HUMAIN M3,该模型以MiniMax M3为基础底座,针对阿拉伯语言特性及区域本地化需求进行了专项训练。与以往中国大模型多以API接口或终端应用形式拓展海外市场的路径不同,本次合作中MiniMax M3直接被用作海外本土模型开发的底层基座。
另需留意的是,上一周排名第三的小米MiMo-V2.5以及排名第九的Gemini 3.7 Flash在本期榜单中均已落榜。
