英偉達稱 Groq 機架將在今年上線,此前以 200 億美元完成收購
我是 LongbridgeAI,我可以總結文章信息。英偉達宣佈 Groq 3 LPX 機架已全面投產,標誌着其 200 億美元收購 Groq 資產後的技術商業化落地。該機架將部署於 Neocloud Nebius 平台,與 Vera CPU 和 Rubin GPU 協同工作,預計今年晚些時候上線。此舉旨在滿足低延遲 AI 推理需求,提升對延遲敏感客户的服務質量。
Nvidia Groq 3 LPU 芯片
英偉達週一宣佈,其 Groq 3 LPX 機架已全面投產,標誌着公司史上最大規模收購所涉及技術的商業化正式落地。
英偉達高級總監 Dion Harris 表示,Groq 機架將部署在 Neocloud Nebius 平台上,與 Vera 中央處理器和 Rubin 圖形處理器協同工作,並將在今年晚些時候上線。
英偉達加緊製造 Groq 芯片並推向客户,凸顯了低延遲推理日益增長的重要性——這是讓 AI 智能體響應迅速、避免用户長時間等待的關鍵,尤其在編程場景中尤為重要。英偉達表示,雲服務商可以為此類 token 收取更高費用。
Harris 在電話會議中稱:“對於提供 token 服務的廠商來説,這為他們提供了向那些對延遲最敏感的客户提供優質服務層級的可能,以滿足相應的服務等級協議。”
去年 12 月,英偉達以 200 億美元收購了芯片初創公司 Groq 的資產,這是公司迄今最大的一筆收購。
Groq 架構在芯片裸片上集成了 500 兆字節的高速 SRAM,以減少內存瓶頸。Groq 芯片由三星代工,而英偉達的 GPU 則由台積電製造。
英偉達將 256 個獨立的 Groq 3 芯片封裝在 LPX 機架中。根據 Artificial Analysis 的基準測試,英偉達稱其 Groq 3 LPX 機架可提供每秒 3400 個 token 的吞吐量。
這是一個競爭激烈的領域。較小的 GPU 製造商AMD今年早些時候宣佈,將把其機架級系統與近期上市的 Cerebras 芯片集成,同樣聚焦低延遲推理。OpenAI 新近宣佈的 “超快模式” 目前承諾每秒 750 個 token,且 “由 Cerebras 提供支持”。
低延遲芯片並不會取代 GPU——GPU 是 AI 芯片的主力,既可進行訓練也可進行推理,且足夠靈活以適應新技術和新模型。像 Groq 這樣的低延遲芯片主要專注於模型服務中的一個環節,即 “解碼” 階段。
Harris 表示:“這不是要取代 GPU,而是要在合適的負載部分使用合適價格、合適的處理器。”
英偉達目前正在加快 Vera Rubin 系統的出貨,該系統已於今年早些時候投產。在 3 月 Vera Rubin 和 Groq 3 LPX 的發佈會上,英偉達 CEO 黃仁勳預計,從當前一代 Blackwell 芯片到新的 Vera Rubin 系統,到 2027 年的累計銷售額將達到 1 萬億美元。
黃仁勳當時表示,他將在專用於編程應用的數據中心空間中,劃出四分之一分配給 Groq 芯片。
黃仁勳説:“我數據中心的其餘部分將全部使用 Vera Rubin。”
英偉達將於週三公佈財報。
