在近日舉辦的Hot Chips 2026大會上,英特爾正式公布了代號為「Crescent Island」的數據中心GPU,這款產品基於全新的Xe3P圖形架構打造,專為AI推理工作負載優化,以350W風冷PCIe形態亮相,最高配備480GB LPDDR5X內存,標誌著英特爾在AI加速器領域邁出了關鍵一步。

Xe3P是英特爾在Xe3基礎上的進一步演進,也是該公司在Panther Lake及Xe3深度解析活動中預告過的下一代圖形架構。與競爭對手不同,英特爾此次將Xe3P定位為一款高度可擴展的架構,從客戶端核顯到數據中心AI GPU,均可靈活適配。在客戶端市場,該架構將搭載於下一代Arc C系列顯卡。


在微架構層面,每個Xe3P核心集成了8個向量引擎和8個XMX引擎。向量引擎支持FP8/FP4精度運算、三指令並發發射以及完整速率的FP64擴展數學運算;XMX單元則提供16級深度脈動陣列,大幅提升矩陣運算效率。此外,每個Xe核心還配備1MB的GRD緩存。

Crescent Island GPU整體由四個計算切片組成,每個切片包含8個核心,共計32個Xe3P核心、256個向量引擎和256個XMX單元。所有計算切片通過大容量L2緩存互聯。


在內存方案上,英特爾選擇了一條與NVIDIA、AMD截然不同的路線。後兩者的數據中心方案普遍採用高端HBM內存,如HBM3E,以及即將量產的HBM4,而Crescent Island則採用LPDDR5X,最高容量可達480GB。英特爾品牌參考卡配備160GB LPDDR5X,合作夥伴則可打造最高480GB的ODM定製版本。
作為對比,AMD Instinct MI450X最高搭載432GB HBM4,NVIDIA Vera Rubin最高為288GB HBM4。在容量上,Crescent Island占據明顯優勢。英特爾表示,LPDDR5X不僅顯著降低功耗和成本,還支持高密度通道設計,帶來可觀的頻寬提升,同時具備ECC保護和PCIe高級錯誤報告等可靠性特性。這一策略對於追求性價比的推理場景尤為有利,尤其契合"Token即服務"提供商的需求。

值得關注的是,Crescent Island去除了傳統GPU中的圖形渲染和3D支持模組,將全部晶片面積用於GPGPU通用計算與AI加速,並在性能/功耗比和性能/總擁有成本上進行了深度優化。該晶片原生支持從FP4到FP64的全譜數據類型,覆蓋語言模型、推理模型、多模態模型及擴散模型等多種AI負載。

在軟體層面,英特爾為Crescent Island構建了開放且完整的AI軟體棧,涵蓋編譯器、庫工具與AI運行時,支持Triton、oneDNN、OpenCL、PyTorch、OpenVINO、SYCL等主流框架。此外,該產品還支持KV緩存感知路由與卸載,以實現可擴展推理;並可與vLLM、SGLang、llm-d及NVIDIA Dynamo等框架協同工作,實現跨異構基礎設施的智能體編排,無需修改智能體代碼。

英特爾還展示了其「智能體AI加速器組合」路線圖,涵蓋從本地智能體計算盒到智能體AI數據中心的全場景應用,Arc Pro GPU與SambaNova SN50 RDU將共同構成這一生態。
英特爾透露,Crescent Island GPU預計於2026年下半年向客戶送樣。隨著AI推理需求持續爆發,這款以大容量、低功耗、低成本為核心賣點的推理加速器,能否在NVIDIA和AMD主導的數據中心AI市場中開闢出一條差異化路徑,值得業界持續關注。






