事关中国,英伟达否认
据The Information报道,英伟达公司计划于今年年底前开始向中国客户小批量交付一款全新定制的人工智能芯片。消息公布后,这家半导体巨头的股价一度上涨,但随后涨幅收窄,最终下跌0.5%。
这款新产品是英伟达语言处理单元 (LPU) 的改进版,采用 Groq 的授权技术开发而成,可与主图形处理器协同工作,加速 AI 模型的响应速度。由于英伟达的下一代 Vera Rubin 架构受美国法规限制无法出口到中国,工程师们修改了 LPU 的软件,使其能够与中国市场上其他可用的处理器配合使用。多家中国企业已订购了这款设备,这将使其与华为即将推出的 Ascend 950DT 等国产推理硬件直接竞争。然而,最终能否获得北京方面的监管批准仍存在风险,因为中国此前曾限制进口外国芯片,以扶持国内半导体巨头。
英伟达的这一战略举措旨在解决中国人工智能领域严重的芯片供应短缺问题。近期,严重的计算瓶颈迫使 Moonshot AI 暂停注册,DeepSeek 也提高了开发者费用。由于中国最大的科技集团已将国内芯片产能锁定至 2027 年,持续的芯片短缺为英伟达提供了一个关键的契机,使其能够在客户永久转向国产架构之前重新吸引他们。
尽管华盛顿方面实施了严格的出口管制,且英伟达首席执行官黄仁勋此前曾表示公司已基本将中国市场拱手让给华为,但此举仍凸显了英伟达维护其中国市场份额的决心。报告显示,除了LPU之外,英伟达还在扩大其已获批准的H200处理器的出货量,其封装合作伙伴安靠科技在第二季度完成了超过100万颗处理器的生产,同时还在独立开发两款针对中国市场的低功耗游戏芯片。
随后,英伟达发布公开更正声明,针对 The Information 的一篇报道。英伟达表示,该报道包含有关 Groq 3 语言处理单元及其战略方向的不准确说法。
Groq 3 LPU 究竟是什么
英伟达的GPU擅长高吞吐量训练和批量推理,能够同时处理海量数据。而Groq 3 LPU的目标则有所不同:它专注于低延迟、高并发的推理工作负载,也就是用户需要实时等待AI响应的任务。
Groq 3 LPU 于 2026 年 3 月 16 日在英伟达 GTC 2026 大会上正式发布,是该公司 Vera Rubin AI 平台的一部分。每颗芯片配备 500 MB 片上 SRAM,并提供 150 TB/s 的推理带宽。在机架级部署中,LPX 系统每个机架集成 256 颗 Groq 3 LPU,专为满足大规模超低延迟需求而设计。
英伟达已明确表示,LPU 的设计初衷是与 GPU 产品线协同工作,而非取代它们。GPU 负责繁重的训练和批量推理任务,而 LPU 则负责处理交互式和智能体 AI 应用,在这些应用中,可预测的单次token延迟至关重要。
