中国AI大模型调用量持续领先:智谱GLM
根据OpenRouter最新统计数据显示,上周全球AI大模型调用总量突破113万亿Token,较前一周增长21.11%。在区域竞争中,中国大模型以55.16万亿Token的调用量连续18周保持领先,增幅达36.26%;美国同期调用量为17.07万亿Token,虽环比增长76.71%,但仍居次席。
全球调用量排行榜呈现显著变化,三款中国大模型包揽前三。其中新晋冠军Ox Alpha(牛来大模型)单周调用量达15.7万亿Token,环比增长36%。这款8月20日上线的模型具备104.8万Token的上下文窗口和13.1万Token的最大输出能力,支持文本、图像、视频多模态输入,预览期间提供免费调用服务。其技术参数与市场策略引发行业持续热议,直至8月26日晚智谱官方确认该模型为GLM-5系列新版本GLM-5.3-Flash。
作为GLM-5系列首个原生多模态模型,GLM-5.3-Flash采用开源策略,定价仅为前代GLM-5.3的十分之一,限时优惠更达二十分之一。这种激进的市场策略取得显著成效,上线首周即以6.16万亿Token的调用量跻身全球第六。此前长期占据榜首的DeepSeek-V4-Flash-0731本周滑落至第二位,调用量12.3万亿Token,增幅收窄至6%;小米MiMo-V2.5保持第三,但调用量环比下降8%至9.14万亿Token。
国际厂商方面,谷歌Gemini 3.7 Flash以120%的环比增速首次入榜,单周调用量达3.95万亿Token。榜单末位则出现剧烈变动,前周排名第八的GLM 5.2和第九的DeepSeek-V4-Pro-0423双双跌出前十。这种格局变化反映出全球AI大模型市场竞争日趋激烈,技术迭代与商业策略的双重博弈持续加剧。
值得关注的是,多模态能力正在成为头部模型的核心竞争力。Ox Alpha与GLM-5.3-Flash的成功,印证了跨模态处理在提升模型实用性方面的关键作用。随着开源生态的完善和定价策略的差异化,AI大模型市场有望形成技术驱动与商业创新并重的新发展格局。
