阿里云灵骏真武M890超节点适配Qwen3.8,为大规模MoE模型推理提供新支撑
发布时间:2026-07-23来源:互联网编辑
阿里云近日宣布,其自主研发的灵骏真武M890超节点实例已成功完成对Qwen3.8大模型的适配,并正式在阿里云百炼平台上线提供推理服务。这一突破标志着国内首次实现超2万亿参数规模大模型在超节点架构上的稳定运行,为人工智能大模型训练与推理提供了新的算力支撑方案。
Qwen3.8作为当前参数规模最大的开源大模型之一,其2.4万亿参数的运算需求对硬件架构提出极高挑战。为满足模型运行要求,阿里云采用分布式计算策略,将参数拆分至数十张通过高速互联技术连接的GPU卡中。真武M890作为平头哥半导体推出的新一代训推一体AI芯片,通过原生支持FP32至FP4多精度计算,为模型运算提供了灵活的算力支持。该芯片搭载的ICN Switch 1.0互联技术,实现了64张芯片间800GB/s的带宽传输,构建起总显存达9TB的超大算力集群。
技术团队针对混合专家模型(MoE)的并行计算特性,对超节点架构进行了深度优化。通过改进芯片间通信协议与内存管理机制,单实例即可支持大规模MoE模型的专家并行推理需求。在针对智能体(Agentic)推理场景的实测中,经过全链路优化的系统架构使推理性能较传统方案提升最高达1.5倍,显著降低了大规模模型部署的时延与成本。
此次技术突破不仅验证了国产AI芯片在超大规模模型训练领域的可行性,更为云计算平台提供了新的算力解决方案。阿里云百炼平台通过整合硬件创新与软件优化,为开发者提供了开箱即用的大模型推理服务,有望推动AI技术在更多垂直领域的落地应用。
转载说明:本文系转载内容,版权归原作者及原出处所有。转载目的在于传递更多行业信息,文章观点仅代表原作者本人,与本平台立场无关。若涉及作品版权问题,请原作者或相关权利人及时与本平台联系,我们将在第一时间核实后移除相关内容。
