CoreWeave近日宣布了一系列新動態,首先是Nvidia全新Vera Rubin NVL72機架級AI平台已正式在其雲服務中上線。
在舊金山舉行的CoreWeave Fully Connected大會上,該公司宣布Devin AI軟體工程智能體的開發商Cognition已成為首個使用Vera Rubin集群的客戶。Cognition於9月初部署了Vera Rubin集群,並運行了CoreWeave所稱的該平台首個由客戶執行的推理基準測試。
在公布此次合作時,Cognition表示,與Nvidia GB200 NVL72基準相比,Vera Rubin NVL72在SWE-2推理工作負載上實現了高達4.8倍的Token總吞吐量提升。該公司還報告稱,在強化學習工作負載方面,輸出Token吞吐量提升了3.8倍。
CoreWeave產品與工程執行副總裁Chen Goldberg表示,公司在工程方面的投入旨在讓客戶能在數天內將新的機架級系統投入生產,而不必針對每一代GPU重建基礎設施流程。
「在處理智能體任務時,長上下文、重複的模型調用以及數千個並發任務會給整個平台帶來壓力,」Goldberg在聲明中說道。「我們的職責是讓計算、網路和軟體作為一個統一系統協同運作。」
他表示,吞吐量的提升可以轉化為每個GPU上更多的Devin並發會話、更快的研發周期,以及在不降低生成速度的前提下更低的單會話成本。
CoreWeave此前已部署了Nvidia GB200和GB300 NVL72系統,其中包括與戴爾科技合作開發的Dell PowerRack配置。該雲服務商表示,其現有客戶將能夠使用與GB200和GB300機群相同的工具和運維方式來操作Vera Rubin算力。
除支持Vera Rubin外,CoreWeave還新增了對Vera CPU的支持,將該處理器定位為應對智能體AI工作負載中日益增長的CPU密集型任務的解決方案。
該公司表示,儘管GPU承擔了模型訓練和推理的主要計算工作,但CPU負責處理隔離執行環境、強化學習工作負載、工具調用、代碼執行以及數據管道等重要任務。Nvidia將Vera描述為首款專為AI智能體及現代AI系統周邊工作負載設計的CPU。
CoreWeave最初部署的Vera系統採用機架級配置,每個機架包含128個Vera CPU,相當於11264個CPU核心。該機架還集成了Nvidia BlueField-4 DPU以及Spectrum-X以太網交換設備,以實現Vera節點間的互聯。CoreWeave表示,該配置提供的CPU算力足以支持超過11000個並發智能體環境。
在軟體方面,CoreWeave推出了名為Forge的全新AI開發平台,旨在將模型訓練、推理、評估和智能體開發整合到同一環境中。
該公司表示,Forge旨在解決一個日益突出的問題:開發工作流程往往分散在多個工具和供應商之間,這使得從生產系統中獲取的資訊難以反饋至訓練環節並用於後續模型疊代。
Forge將實驗跟蹤、評估、智能體可觀測性、後訓練、推理和模型管理整合在一起。CoreWeave表示,該平台的設計理念是讓團隊能夠使用自己偏好的模型、框架和雲環境,而不是被鎖定在單一的AI技術棧中。
該公司將Forge描述為一個持續的AI開發閉環,團隊可以在其中運行模型和智能體、觀察其行為、整理數據、進行改進、評估結果,並不斷重複這一過程。
CoreWeave表示,其正在將自身的軟體棧定位為一種方式,讓客戶能夠在不改變運維模式的情況下,在不同代際的Nvidia GPU之間進行遷移。該公司的平台包括其Kubernetes服務、SUNK、Mission Control、Sandboxes以及無伺服器推理產品。
CoreWeave表示,Forge現已上線,Pro版本提供30天免費試用。
Q&A
Q1:CoreWeave的Vera Rubin集群有什麼性能優勢?
A:根據首個客戶Cognition的實測數據,與Nvidia GB200 NVL72基準相比,Vera Rubin NVL72在SWE-2推理工作負載上實現了高達4.8倍的Token吞吐量提升,強化學習工作負載的輸出Token吞吐量則提升了3.8倍。
Q2:Vera CPU主要用來做什麼?
A:Vera CPU被Nvidia定位為首款專為AI智能體設計的處理器,主要負責處理隔離執行環境、強化學習工作負載、工具調用、代碼執行以及數據管道等CPU密集型任務,彌補GPU在這些環節的不足。
Q3:Forge平台的核心功能是什麼?
A:Forge是CoreWeave推出的AI開發平台,整合了實驗跟蹤、評估、智能體可觀測性、後訓練、推理和模型管理等功能,幫助團隊形成從運行、觀察、改進到評估的持續AI開發閉環,且支持多種模型和框架。






