宅中地 - 每日更新
宅中地 - 每日更新

贊助商廣告

X

英偉達重新啟動Rubin CPX項目:以HBM4替換GDDR7

2026年09月02日 首頁 » 熱門科技

去年9月,英偉達推出了Rubin CPX。這是一款專為大規模上下文推理而設計的新款GPU,也是英偉達第一款專為大規模上下文AI應用場景打造的CUDA GPU,其中模型可以同時對數百萬個tokens進行推理。去年10月GTC DC 2025大會上展示的路線圖裡,還能看到Rubin CPX。不過到了今年3月的GTC 2026,展示的路線圖包含了新發布的LP30 LPU及對應的Groq 3 LPX機架,而Rubin CPX卻消失了。外界猜測,Rubin CPX的位置可能被LPU所取代。

據TECHPOWERUP報道,英偉達已經重新啟動之前被擱置的Rubin CPX項目,打算更改設計後重新推出。在這次的新設計里,英偉達更改了DRAM架構,Rubin CPX將採用HBM4,而不是原來的GDDR7,容量從128GB增至168GB。

英偉達重新啟動Rubin CPX項目:以HBM4替換GDDR7

目前推理過程包括有上下文階段和生成階段兩個截然不同的階段,兩者對基礎設施的要求本質上完全不同。其中上下文階段屬於計算受限(compute-bound),需要高吞吐量的處理能力來攝取並分析大量輸入數據,從而生成首個輸出token;生成階段則屬於記憶體頻寬受限(memory bandwidth-bound),依賴高速的記憶體傳輸和高頻寬互聯(比如NVLink),以維持逐個token的輸出性能。

當前頂級GPU都是針對生成階段的設計,不過在在解碼階段,HBM的作用沒那麼明顯。英偉達原來打算在Rubin GPU旁邊再加入Rubin CPX GPU,改用GDDR降低成本,通過分離處理兩個階段,可以更好地對計算和記憶體資源進行優化,從而顯著提升算力的利用率。

Rubin CPX可提供30 PetaFLOPs的NVFP4算力,並集成了4個NVENC編碼器和4個NVDEC解碼器。改用HBM4之後,或許還要重新設計封裝,換成台積電(TSMC)的CoWoS-S或CoWoS-L封裝。未來Rubin CPX將安裝在獨立機架中,配置範圍從64到256個GPU不等,英偉達建議與Rubin GPU保持1:1配比使用。

宅中地 - Facebook 分享 宅中地 - Twitter 分享 宅中地 - Whatsapp 分享 宅中地 - Line 分享
相關內容
Copyright ©2026 | 服務條款 | DMCA | 聯絡我們
宅中地 - 每日更新