Xe3P架构首秀!英特尔Crescent Island细节曝光
8月25日消息,在Hot Chips 2026大会上,英特尔展示了面向智能体AI及企业级工作负载的三款架构,包括适用于以更高性能去调度与协同的Diamond Rapids处理器、支持高效推理的Crescent Island GPU,以及用于智能客户端与边缘计算的Wildcat Lake SoC。
其中代号Crescent Island(新月岛)的全新GPU加速器,是一款专为AI推理与智能体工作负载打造的低功耗、易部署GPU,不再兼顾传统的图形渲染性能。
Crescent Island采用标准PCIe 5.0 x16规格,整卡TDP功耗350W,配套成熟风冷散热方案,企业可以直接在现有风冷服务器上架部署,无需改造昂贵的液冷基础设施,通过合作伙伴的定制方案,其容量最高可扩展至480GB。
架构层面,Crescent Island首发搭载第三代Xe架构增强版本Xe3P,Xe3P是Panther Lake处理器内置Xe3架构的迭代增强版本,按照英特尔路线规划,这套架构未来将落地PC客户端、数据中心、边缘计算、工作站多条产品线,具备很高的通用性与拓展潜力。
为拔高AI推理能效,英特尔还对Xe3P核心做了大规模改造,AI矩阵计算XMX单元,从Xe2、初代Xe3的4层深度脉动阵列升级到16层,原生新增支持FP4、FP8低精度AI计算,同时完整覆盖FP16、FP32直至FP64全精度。
单Xe核心寄存器堆容量直接翻倍至1MB,L1缓存与SLM共享局部缓存提升到512KB,减少数据读写延迟,提升大模型吞吐能力。
芯片设计上,Crescent Island贯彻去图形化思路,完全移除3D渲染、光线追踪全套硬件模块,把节约下来的全部晶体管资源投入Xe计算核心与AI加速单元。
整卡内部划分4组Compute Slice计算块,集成32个Xe3P核心,合计拥有256个矢量引擎、256个XMX矩阵AI引擎,全部算力资源服务AI推理任务。
软件生态上,该加速器原生适配vLLM、SGLang、PyTorch等当下主流AI推理框架,降低企业落地大模型的适配成本。
