智谱GLM
发布时间:2026-08-27来源:互联网编辑
智谱近日宣布,其GLM-5系列的首个原生多模态模型——GLM-5.3-Flash (320B-A18B)正式上线并开源。这一新模型在架构设计上进行了重大创新,旨在以极低的成本实现高性能,为人工智能领域带来了新的突破。
在正式发布前,智谱以匿名模型Ox-Alpha(中文社区昵称“牛来”)在OpenCode和OpenRouter平台上进行了大规模测试。测试结果显示,Ox-Alpha迅速成为当周最受欢迎的模型,在两个平台上均创下了调用量新高。尤为引人注目的是,这些请求流量全部由国产芯片提供算力支持,展现了国产芯片在大规模场景下的强大实力。
GLM-5.3-Flash在基准测试和实际应用中均表现出色,全面超越了参数量高出一倍的GLM-5.2模型。然而,其定价却仅为GLM-5.2的十分之一,这得益于其全新的模型架构。该架构专为降低成本而设计,总参数量与GLM-4.5相当,但激活参数量和层数几乎减半,从而显著降低了计算资源的需求。结合最新的30T Token多模态预训练语料,GLM-5.3-Flash能够以更少的资源实现更强的性能。
智谱方面透露,过去一周内,他们首次尝试使用大国产芯片集群为大规模流量提供服务。这些芯片通过自研的高带宽互联网络连接,实现了高效的协同工作。与同一硬件上的初始基线相比,端到端服务性能提升了三倍,硬件效率和单Token成本已达到与主流英伟达GPU相当的水平。这一成果证明,国产芯片完全有能力在大规模场景下高效、经济地支撑前沿模型的推理需求,为人工智能的发展提供了新的可能性。
转载说明:本文系转载内容,版权归原作者及原出处所有。转载目的在于传递更多行业信息,文章观点仅代表原作者本人,与本平台立场无关。若涉及作品版权问题,请原作者或相关权利人及时与本平台联系,我们将在第一时间核实后移除相关内容。
