Rain科技8月31日消息,今日,每经根据OpenRouter最新数据测算,上周(8月24日至8月30日)全球AI大模型总调用量为113万亿Token,环比增长21.11%。这一数据表明,AI大模型的应用需求仍在快速扩张,全球市场对高性能、低成本模型的竞争日趋激烈。
其中上榜的AI大模型中,中国AI大模型周调用量达55.16万亿Token,环比增长36.26%。
同期美国AI大模型周调用量为17.07万亿Token,环比增长76.71%,中国大模型周调用量连续18周超过美国,稳居全球首位。 值得注意的是,虽然美国模型增速更快(76.71%对中国36.26%),但中国凭借庞大的调用基数以及持续增长的势头,仍保持绝对领先,反映出中国在模型部署和用户规模上的深厚积累。
上周全球调用量排名前三均为中国AI大模型,其中代号为Ox Alpha(牛来大模型)的匿名模型升至第一,周调用量达15.7万亿Token,环比增长36%。
Ox Alpha于8月20日上线,其上下文窗口约为104.8万Token,最大输出长度为13.1万Token,同时支持文本、图像和视频输入,预览期间可以免费调用。这种“大窗口+多模态+免费试用”的策略,直接拉动了调用量的爆发式增长,也解释了为何它能迅速登顶。
凭借亮眼的调用数据与硬核性能表现,这款匿名大模型自面世以来,引发业界广泛讨论与多方猜测。分析人士指出,匿名上架模式往往用于测试市场反应或掩盖模型来源,而Ox Alpha的迅速走红也验证了“免费+强性能”对用户的吸引力。
8月26日晚,智谱公开认领了Ox Alpha,确认其为GLM系列新版本GLM-5.3-Flash,并已开源。
该模型为GLM-5系列首个原生多模态版本,定价为GLM-5.3的十分之一,限时折扣为二十分之一,上线当周GLM-5.3-Flash便冲上榜单,排名第六,周调用量达6.16万亿Token。这种低价策略无疑加剧了市场竞争,也促使其他厂商加速优化成本。

此前一周位居榜首的DeepSeek-V4-Flash-0731(即DeepSeek-V4-Flash正式版)降至第二,周调用量达12.3万亿Token,环比增长6%;小米MiMo-V2.5连续两周位居第三,周调用量达9.14万亿Token,环比下滑8%。可以看到,头部模型之间的差距在缩小,小米MiMo虽排名稳定但调用量出现下滑,说明用户注意力可能被新晋模型分散。
谷歌Gemini 3.7 Flash首次登上榜单,周调用量达3.95万亿Token,环比增长120%。这一增幅表明,国际巨头正在加速追赶,尤其在多模态和推理能力上发力明显。随着更多海外模型进入中国市场,竞争格局将更加复杂。
值得注意的是,此前一周排名第八的GLM 5.2、排名第九的DeepSeek-V4-Pro-0423均跌出榜单。 这种快速更迭说明,AI大模型市场尚处“洗牌期”,模型迭代速度和用户偏好变化极快,只有持续优化性能、控制成本并保持开放生态的模型才能长期留在榜单。
