英特尔Hot Chips详解Crescent Island AI加速器架构
在近日举行的Hot Chips研讨会上,英特尔详细披露了其基于Xe3P架构的Crescent Island AI加速器的核心设计。该产品明确区别于英伟达与AMD主打的高功耗液冷训练卡,定位于350W风冷PCIe推理加速市场,旨在直接部署于现有数据中心基础设施。 架构层面,Crescent Island由四个Xe3P切片构成,集成32个Xe核心与256个XMX矩阵加速器。其缓存层级显著强化,单核通用寄存器与L1缓存分别扩容至1MB和512KB,并配备32MB共享L2缓存,有效降低寄存器溢出与数据延迟。XMX引擎采用16级脉动阵列,大幅突破以往4级设计的矩阵吞吐瓶颈。计算单元覆盖从FP4到FP64全精度格式,并内置Sigmoid与Tanh硬件加速,兼顾AI推理与高性能计算融合场景。芯片保留四组媒体编解码模块,但移除图形光追单元以最大化算力密度。 针对混合专家模型与推测解码趋势,英特尔强调该设计通过提升缓存命中率与单次矩阵处理量,有效对冲LPDDR5X内存带宽限制,专为预填充等计算密集型推理负载优化。产品计划于2026年下半年量产,将与SambaNova异构方案形成生态协同,在低功耗AI推理细分市场建立差异化壁垒。
此资讯由 AI 智能聚合生成,旨在高效传递行业动态,不代表任何观点或建议。
