📢 𝗝𝗨𝗦𝗧 𝗜𝗡: CoreWeave 將多機架 NVIDIA Vera Rubin NVL72 集羣引入其 AI 雲 - $Coreweave(CRWV.US) $英偉達(NVDA.US)
👉 𝗞𝗲𝘆 𝗛𝗶𝗴𝗵𝗹𝗶𝗴𝗵𝘁𝘀:➤ 𝗖𝗼𝗿𝗲𝗪𝗲𝗮𝘃𝗲將其𝗡𝗩𝗜𝗗𝗜𝗔 𝗩𝗲𝗿𝗮 𝗥𝘂𝗯𝗶𝗻 𝗡𝗩𝟳𝟮部署至雲端。➤ 集羣連接了數百個𝗥𝘂𝗯𝗶𝗻 𝗚𝗣𝗨,以支持𝗮𝗴𝗲𝗻𝘁𝗶𝗰 𝗔𝗜工作負載。➤ 每個 NVL72 機架將𝟳𝟮個𝗥𝘂𝗯𝗶𝗻 𝗚𝗣𝗨與𝟯𝟲個𝗩𝗲𝗿𝗮 𝗖𝗣𝗨相結合。➤ 𝗡𝗩𝗜𝗗𝗜𝗔 𝗦𝗽𝗲𝗰𝘁𝗿𝘂𝗺-𝗫以太網將多個機架連接為擴展式集羣。➤ 每個 Rubin GPU 可獲得高達𝟭.𝟲 𝗧𝗯/𝘀的擴展連接速度。➤ 𝗖𝗼𝗿𝗲𝗪𝗲𝗮𝘃𝗲 𝗠𝗶𝘀𝘀𝗶𝗼𝗻 𝗖𝗼𝗻𝘁𝗿𝗼𝗹自動化了機架設置、驗證、供電和冷卻流程。➤ LOTA 提供本地 NVMe 級讀取速度,單 GPU 可達𝟳 𝗚𝗕/𝘀。➤ 與傳統存儲集羣讀取相比,LOTA 將延遲降低了𝟴倍。➤ 新的𝗰𝗿𝗼𝘀𝘀-𝗿𝗲𝗴𝗶𝗼𝗻 𝘄𝗿𝗶𝘁𝗲 𝗮𝗰𝗰𝗲𝗹𝗲𝗿𝗮𝘁𝗶𝗼𝗻最大限度地減少了 AI 檢查點延遲。➤ 新的𝗔𝗿𝗰𝗵𝗶𝘃𝗲層級旨在降低長期 AI 數據存儲成本。👉 𝗪𝗵𝘆 𝗧𝗵𝗶𝘀 𝗠𝗮𝘁𝘁𝗲𝗿𝘀:➤ 擴大了 CoreWeave 進行大規模𝗮𝗴𝗲𝗻𝘁𝗶𝗰 𝗔𝗜訓練和推理的能力。➤ 更快的存儲訪問可以減少 GPU 空閒時間並提高利用率。➤ 多機架 Rubin 支持更大規模的模型和𝗿𝗲𝗶𝗻𝗳𝗼𝗿𝗰𝗲𝗺𝗲𝗻𝘁 𝗹𝗲𝗮𝗿𝗻𝗶𝗻𝗴規模化應用。➤ 跨區域加速解決了分佈式 AI 基礎設施中的一個關鍵瓶頸。👉 𝗘𝘅𝗽𝗲𝗿𝘁 𝗦𝘁𝗮𝘁𝗲𝗺𝗲𝗻𝘁𝘀:𝗖𝗵𝗲𝗻 𝗚𝗼𝗹𝗱𝗯𝗲𝗿𝗴, CoreWeave 產品與工程執行副總裁:“CoreWeave 是首家驗證並上線 Vera Rubin NVL72 的 AI 雲服務提供商,證明了這種先進的機架級架構可以作為可靠的高性能雲服務運行。通過多機架 Vera Rubin,我們將數百個 Rubin GPU 連接為一個單一的擴展集羣。對於構建 Agentic AI 的客户而言,這意味着更大的規模、更快的迭代以及更高的生產力,因為模型和智能體在不斷學習和改進。”𝗖𝗲́𝗰𝗶𝗹𝗲 𝗥𝗼𝗯𝗲𝗿𝘁-𝗠𝗶𝗰𝗵𝗼𝗻, Cohere 內部基礎設施總監:“我們的數據集跨越多個區域,我們無法承受因跨區域檢索延遲而打亂訓練計劃。CoreWeave AI 對象存儲為我們提供了跨區域的統一數據集足跡,並在本地緩存讀取數據,因此沒有任何內容會等待網絡傳輸。這是在圍繞數據進行規劃與直接進行訓練之間的區別。”






