智谱GLM
发布时间:2026-08-26来源:互联网编辑
智谱AI近日正式发布全新轻量级旗舰模型GLM-5.3 Flash,该产品直接对标国际同类竞品DeepSeek V4 Flash,其核心优势在于通过十万级国产芯片集群实现全链路自主算力支撑,标志着国产大模型在硬件基础设施领域取得突破性进展。
技术架构方面,GLM-5.3 Flash采用混合专家(MoE)架构设计,总参数量达3200亿但实际激活参数仅180亿,这种创新设计使其在保持高性能的同时显著降低计算资源消耗。与常规小模型通过大模型压缩生成不同,该模型采用独立架构研发路径,综合评测显示其性能已超越前代旗舰GLM-5.2,达到国际主流闭源模型水平。
在多模态处理能力上,GLM-5.3 Flash原生支持图文视频混合输入,可同时处理多种形式的数据内容。价格策略方面,该模型定价仅为同系列GLM-5.3的十分之一,上线初期更推出半价优惠活动,在常规业务场景中展现出显著的成本优势。此前以Ox Alpha代号进行的海外匿名测试显示,该模型5天内累计流量突破50TB,创下测试平台流量增长纪录。
算力基础设施是此次发布的最大亮点。智谱AI构建的十万级国产芯片推理集群整合了华为昇腾、海光、摩尔线程等多家厂商的硬件资源,形成兼容性极强的异构计算体系。虽然具体芯片型号尚未公开,但这种规模化部署验证了国产算力支撑大模型推理的可行性,有效降低对海外GPU的依赖程度。
行业分析指出,随着企业AI应用需求激增,兼具高性能与经济性的轻量级模型正成为市场主流。GLM-5.3 Flash的推出不仅在产品层面形成直接竞争,更通过十万级国产芯片集群的落地应用,为国内算力基础设施建设提供了重要实践案例。这种"模型+算力"的协同发展模式,或将推动国产AI生态进入新的发展阶段。
转载说明:本文系转载内容,版权归原作者及原出处所有。转载目的在于传递更多行业信息,文章观点仅代表原作者本人,与本平台立场无关。若涉及作品版权问题,请原作者或相关权利人及时与本平台联系,我们将在第一时间核实后移除相关内容。
