智谱牛来登顶,深度求索跌出榜,中国大模型调用量十八周连冠

Rain科技8月31日消息,今日,每经根据OpenRouter最新数据测算,上周(8月24日至8月30日)全球AI大模型调用量为113万亿Token,环比增长21.11%。这一数据表明,AI大模型的应用需求仍在快速扩张,全球市场对高性能、低成本模型的竞争日趋激烈。

其中上榜的AI大模型中,中国AI大模型周调用量达55.16万亿Token,环比增长36.26%。

同期美国AI大模型周调用量为17.07万亿Token,环比增长76.71%,中国大模型周调用量连续18周超过美国,稳居全球首位。 值得注意的是,虽然美国模型增速更快(76.71%对中国36.26%),但中国凭借庞大的调用基数以及持续增长的势头,仍保持绝对领先,反映出中国在模型部署和用户规模上的深厚积累。

上周全球调用量排名前三均为中国AI大模型,其中代号为Ox Alpha(牛来大模型)的匿名模型升至第一,周调用量达15.7万亿Token,环比增长36%。

Ox Alpha于8月20日上线,其上下文窗口约为104.8万Token,最大输出长度为13.1万Token,同时支持文本、图像和视频输入,预览期间可以免费调用。这种“大窗口+多模态+免费试用”的策略,直接拉动了调用量的爆发式增长,也解释了为何它能迅速登顶。

凭借亮眼的调用数据与硬核性能表现,这款匿名大模型自面世以来,引发业界广泛讨论与多方猜测。分析人士指出,匿名上架模式往往用于测试市场反应或掩盖模型来源,而Ox Alpha的迅速走红也验证了“免费+强性能”对用户的吸引力。

8月26日晚,智谱公开认领了Ox Alpha,确认其为GLM系列新版本GLM-5.3-Flash,并已开源。

该模型为GLM-5系列首个原生多模态版本,定价为GLM-5.3的十分之一,限时折扣为二十分之一,上线当周GLM-5.3-Flash便冲上榜单,排名第六,周调用量达6.16万亿Token。这种低价策略无疑加剧了市场竞争,也促使其他厂商加速优化成本。

中国AI大模型调用量连续18周领跑:智谱牛来大模型登顶 DeepSeek-V4-Pro跌出榜单

此前一周位居榜首的DeepSeek-V4-Flash-0731(即DeepSeek-V4-Flash正式版)降至第二,周调用量达12.3万亿Token,环比增长6%;小米MiMo-V2.5连续两周位居第三,周调用量达9.14万亿Token,环比下滑8%。可以看到,头部模型之间的差距在缩小,小米MiMo虽排名稳定但调用量出现下滑,说明用户注意力可能被新晋模型分散。

中国AI大模型调用量连续18周领跑:智谱牛来大模型登顶 DeepSeek-V4-Pro跌出榜单

谷歌Gemini 3.7 Flash首次登上榜单,周调用量达3.95万亿Token,环比增长120%。这一增幅表明,国际巨头正在加速追赶,尤其在多模态和推理能力上发力明显。随着更多海外模型进入中国市场,竞争格局将更加复杂。

值得注意的是,此前一周排名第八的GLM 5.2、排名第九的DeepSeek-V4-Pro-0423均跌出榜单。 这种快速更迭说明,AI大模型市场尚处“洗牌期”,模型迭代速度和用户偏好变化极快,只有持续优化性能、控制成本并保持开放生态的模型才能长期留在榜单。

免责声明:本网站内容主要来自原创、合作伙伴供稿和第三方自媒体作者投稿,凡在本网站出现的信息,均仅供参考。本网站将尽力确保所提供信息的准确性及可靠性,但不保证有关资料的准确性及可靠性,读者在使用前请进一步核实,并对任何自主决定的行为负责。本网站对有关资料所引致的错误、不确或遗漏,概不负任何法律责任。任何单位或个人认为本网站中的网页或链接内容可能涉嫌侵犯其知识产权或存在不实内容时,可联系本站进行审核删除。
(0)
Rain科技Rain科技
华为鸿蒙折叠电脑小尺寸版,配独立外屏价更香
上一篇 3小时前
百度股价下跌,腾讯股价上涨,苹果与腾讯、字节跳动AI合作传闻
下一篇 2024年 12月 20日 上午11:17

相关推荐

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注