华为星河AI数据中心网络方案打造Token高效生产网
2026中国算力大会·智算网络创新
发展论坛
在河北廊坊成功举办。华为数据
通信
产品线数据
中心
网络领域解决方案首席架构师赵笑可受邀出席并发表演讲,剖析
AI
时代算力产业发展趋势,围绕TCO(综合建网投资)、TPS(Token生产效率)、Uptime(有效运行时间)三大核心维度,详细解读华为星河AI数据中心网络方案,为行业智算网络降本增效与规模化部署提供实践参考。
赵笑可在演讲中指出,过去两年全国日均Token(词元)调用量从百亿级增至140万亿,增长超千倍。Token已从大模型技术计量单位,演变为AI时代可定价、可交易、可结算的新型
商品
;数据中心从“传统
IDC
”向“Token工厂”转型,行业比拼重心也从
GPU
数量转向Token生产效率,对AI集群规模、性能、可靠性也提出了更为严格的要求,算力网络成为降本增效关键。
针对上述诉求,华为星河AI数据中心网络方案基于业界前沿的AI Fabric智能算网理念,围绕大规模组网、高性能、高可靠三大方向持续创新,打造业界领先的Token生产网。
在大规模组网方面,华为推出全新的星阵多平面架构,以及业界最高密128×800GE智算
交换机
CloudEngine XH9330,组网规模达到业界4倍;CloudEngine智算交换机主动感知故障,并联动计算节点完成跨平面链路切换,无需配置逃生交换机;在128K集群场景下,华为两层四平面组网相较业界主流三层组网,智算交换机及光模块数量大幅减少,综合建网投资可节省30%。
在高性能方面,华为率先推出星域超融合架构,实现NPU计算节点直通存储节点,相较于传统存算分离架构,将KV Cache传输带宽提升8倍,TPS性能提升4.8倍;在此基础上,依托独家CAQM网算协同能力,智算交换机实时感知链路资源状态并智能调度,实现数据零拥塞,P99时延降低20%以上,TPS性能可再提升15~20%。
在高可靠方面,华为采用软硬结合方式,为客户提供设备级、链路级及模块级的超高可用能力,保证算力网络长稳运行。全新升级的iFlashboot闪启2.0,将设备重启时间从10秒压缩至5秒以内,实现AI训推零中断;新增LLR链路级重传机制,解决
端口
故障、链路闪断、光通道失效等难题,实现业务零丢包;同时借助高集成设计,光模块组件从20个减至7个,故障点减少65%,年化失效率低于2‰,可靠性两倍于业界。
赵笑可表示,未来华为将持续深耕数据中心网络技术创新与智能化升级,打造高效、可靠、经济的Token生产网,助力算力产业规模化落地,加速千行百业数智化转型升级。
华为
华为
+关注
关注
218
文章
36707
浏览量
264831
网络
网络
+关注
关注
14
文章
8529
浏览量
97634
数据通信
数据通信
+关注
关注
2
文章
592
浏览量
35507
原文标题:活动速递 | 共织算力网,智启新未来,华为星河AI数据中心网络方案打造Token高效生产网
文章出处:【微信号:Huawei_Fixed,微信公众号:华为数据通信】欢迎添加关注!文章转载请注明出处。
