全球AI大模型调用量激增:中国模型持续领跑,智谱新模型登顶DeepSeek
根据OpenRouter最新发布的数据显示,全球AI大模型市场在近期迎来显著增长。上周,全球AI大模型的总调用量达到113万亿Token,较前一周增长21.11%。这一数据反映出AI技术在全球范围内的应用持续升温。
在区域表现方面,中国AI大模型继续保持领先地位,周调用量达55.16万亿Token,环比增长36.26%。相比之下,美国AI大模型的周调用量为17.07万亿Token,虽然环比增长76.71%,但总量仍远低于中国。值得注意的是,中国大模型的周调用量已连续十八周超过美国,稳居全球首位。
在具体模型排名中,中国AI大模型包揽了全球前三名。其中,一款代号为Ox Alpha的匿名模型表现尤为突出,首次登顶榜首,周调用量达15.7万亿Token,环比增长36%。该模型于8月20日上线,具备约104.8万Token的上下文窗口和13.1万Token的最大输出长度,支持文本、图像和视频输入,并在预览期间提供免费调用服务。
性能测试方面,独立研究员本·戴维斯通过软件工程基准DeepSWE中的10个子任务对Ox Alpha进行评估,结果显示其通过率约为80%,显著高于Claude Fable 5的65%、GLM-5.3和Grok 4.6的62%,以及GPT-5.6 Sol的52%。这一表现引发了业界广泛关注。
随后,智谱公开确认Ox Alpha为其GLM系列新版本GLM-5.3-Flash,并宣布该模型已开源。作为GLM-5系列的首个原生多模态版本,GLM-5.3-Flash的定价仅为GLM-5.3的十分之一,限时折扣为二十分之一。上线首周,该模型便以6.16万亿Token的周调用量跻身全球第六。
此前一周的榜首DeepSeek-V4-Flash-0731(即DeepSeek-V4-Flash正式版)降至第二名,周调用量为12.3万亿Token,环比增长6%。小米MiMo-V2.5连续两周位列第三,周调用量为9.14万亿Token,但环比下降8%。
谷歌Gemini 3.7 Flash首次进入榜单,以3.95万亿Token的周调用量排名第四,环比增长120%。该模型于8月14日推出,重点升级了编程、智能体应用、Web开发及复杂知识工作能力,被谷歌定义为“迄今为止用于编码和智能体领域最智能的Flash级主力模型”。为吸引开发者,谷歌推出限时优惠价格:在12月31日前,每百万输入Token仅收0.75美元,每百万输出Token仅收3.75美元,相当于原价五折。
与此同时,部分模型排名出现下滑。此前一周排名第八的GLM 5.2和排名第九的DeepSeek-V4-Pro-0423未能继续留在榜单前十。
