英特尔公布了其下一代AI推理加速器Crescent Island的详细规格,该加速器搭载32个Xe3核心和480 GB LPDDR5X内存。

英特尔将凭借Xe3P驱动的Crescent Island GPU进军智能体AI加速器领域,通过LP5X内存与350W TDP实现低成本与低功耗
英特尔的Crescent Island GPU基于全新的Xe3P架构,这也是该公司在Panther Lake和Xe3深度解析期间预告过的同款图形架构。
Crescent Island的新硅片特性包括:
智能体AI就绪:高内存容量与持续计算能力
LPDDR5X:更高密度、更低功耗,无带宽/容量损失的情况下增强可靠性
AI优化:更大上下文长度、更高内存,以及性能/TCO的提升
预填充优化:高FLOP/W,适合计算密集型工作负载
Crescent Island的软件创新包括:
广泛的模型支持:支持语言、推理、多模态和扩散模型
KV缓存效率:支持KV缓存感知路由和卸载,实现可扩展推理
开放框架生态:专为兼容vLLM、SGLang、llm-d和NVIDIA Dynamo而构建
异构智能体编排:无需更改智能体代码即可在异构基础设施上运行
新的GPU架构将是Xe3架构的进一步升级,面向客户端市场,该架构将应用于下一代Arc系列——Arc C系列。但Xe3P将具备更强的可扩展性,覆盖从客户端iGPU到数据中心AI GPU的广泛领域。
Xe3P微架构——优化每瓦性能
480 GB LPDDR5X内存
支持广泛的数据类型,非常适合“令牌即服务”提供商和推理应用场景
英特尔Crescent Island将在功率和成本两方面进行优化。它将面向风冷数据中心解决方案和工作站,瞄准AI推理工作负载。据英特尔称,用于Crescent Island的Xe3P图形架构将针对每瓦性能进行优化。
英伟达(NVIDIA)和AMD等竞争对手正以顶级HBM内存(如HBM3E)提供其数据中心AI解决方案,并且已开始为Rubin和MI450X等下一代部件出货首批HBM4解决方案。但与此同时,由于需求增加,采购HBM变得困难,这也导致了价格上涨。仅作比较:
英特尔Crescent Island——最高480 GB(LPDDR5X)
AMD Instinct MI450X——最高432 GB(HBM4)
英伟达Vera Rubin——最高288 GB(HBM4)
Xe3P IP专为AI优化
英特尔Crescent Island GPU将搭载代号为Xe3P的第三代Xe架构。英特尔表示,该架构利用多代Xe安装基础,在效率和软件兼容性方面均有改进。基于Xe3P的Crescent Island GPU专为AI进行了优化。
在架构层面,第三代Xe核心“Xe3P”每个Xe核心搭载8个向量引擎和8个XMX引擎。Xe向量引擎现在支持FP8+FP4精度、三路并发、扩展数学与FP64(全速率64 FMA/Xe核心)能力,而Xe矩阵扩展(XMX)单元提供16深度脉动阵列。每个Xe核心还配备1 MB的GRD。
Crescent Island GPU由四个计算切片组成。每个切片包含8个核心,因此总共提供32个Xe3P核心、256个向量引擎和256个XMX单元。每个Xe核心保留加载/存储单元、专用I$以及L1$/SLM缓存。所有计算切片都连接到大型L2缓存。
在内存子系统方面,英特尔的Xe3P“Crescent Island”GPU每个Xe核心配备512 KB的L1$/SLM,总计16 MB,外加32 MB的统一L2缓存,以及最高480 GB的LPDDR5X内存。英特尔自有品牌解决方案将配备160 GB的LPDDR5X内存。
LPDDR5X为Crescent Island GPU节省功耗与成本
利用LPDDR5X内存可以为英特尔在性价比领域带来巨大优势。此外,该架构将支持广泛的数据类型,非常适合“令牌即服务”提供商和推理应用场景。这正是英特尔大力押注Crescent Island的原因。
从规格说起,英特尔Crescent Island数据中心GPU将配备最高480 GB的LPDDR5X容量。英特尔参考设计的PCIe显卡将配备160 GB的LP5X内存,但合作伙伴将拥有构建ODM品牌显卡的自由,可灵活配置最高480 GB的方案。
采用LP5X内存还显著降低了功耗,风冷PCIe版本的TDP仅为350W。英特尔表示,LP5X内存实现了高密度通道设计,从而带来显著的带宽提升。我们已经看到首批支持最高160 GB内存的PCIe显卡,因此合作伙伴的显卡应该会更加令人期待。
关于Crescent Island的另一点是,传统的GPU模块(如图形或3D支持)被移除。该芯片只专注于GPGPU,这释放了更多裸片面积用于额外的AI计算。此外,该芯片针对Perf/Watt和Perf/TCO进行了优化。
这款GPU将得到从FP4到FP64的广泛数据格式支持,并将支持完全开放且稳健的软件栈。英特尔已在其现有的Arc Pro B系列产品线中评估其面向异构AI系统的开放统一软件栈,因此未来的迭代产品将能尽早获得这些优化。英特尔目前的目标是在2026年下半年为其Crescent Island GPU提供客户样品,因此在未来几个月内我们肯定会了解到更多有关该GPU的信息。



