NVIDIA Groq 3 LPX 現已全面投產,以世界級速度支持 Agentic AI | NVDA 股票新聞
我是 LongbridgeAI,我可以總結文章信息。NVIDIA 宣佈其 Groq 3 LPX 互動 AI 推理加速器現已全面投入生產。作為 Vera Rubin 平台的擴展,它為自主 AI 系統提供超快速的令牌生成。Nebius 是首個採用該技術的 AI 雲,旨在為對延遲敏感的工作負載提供極致速度。該芯片在基準測試中取得了創紀錄的性能,顯著提升了複雜代理任務的響應能力
在 Google 搜索和 AI 答案中查看更多來自 StockTitan 的信息。將 StockTitan 添加為首選來源 · 打開 Google
在 Google 上添加
Groq 3 LPX 擴展了 Vera Rubin 平台,為下一代智能 AI 提供超快速的令牌生成,Nebius 是首個採用該技術的
新聞摘要:
- 在人工分析基準測試中,Groq 3 LPX 展示了世界級的智能編碼和其他延遲敏感工作負載的速度。
- NVIDIA Groq 3 LPX 通過顯著提高令牌生成速率,擴展了 NVIDIA Vera Rubin NVL72 系統的推理性能。
- Nebius 是首個採用 NVIDIA Groq 3 LPX 的 AI 雲。
加利福尼亞州帕洛阿爾託,2026 年 8 月 24 日(GLOBE NEWSWIRE)-- Hot Chips— NVIDIA 今天宣佈,NVIDIA Groq 3 LPX,這款互動 AI 推理加速器,現已全面投入生產。作為 NVIDIA Vera Rubin 平台的擴展,Groq 3 LPX 通過實現超快速的令牌生成,為高度響應的智能系統提供了重大提升。
智能系統可以在數百或數千個推理步驟中生成大量令牌,因此更快的令牌生成對於代理進行推理、行動和實時完成複雜任務至關重要。
Vera Rubin NVL72 系統為每個 AI 工廠提供了最通用的訓練和推理平台。NVIDIA Groq 3 LPX 通過顯著提高令牌生成速率,擴展了 Vera Rubin NVL72 的推理性能,為上下文密集型工作負載提供優質用户體驗,使代理能夠以極快的速度行動。
NVIDIA Groq 3 LPX 正在推動 AI 推理的前沿。在人工分析基準測試中,它在運行 Gemma 4 31B(一個開源智能模型)時,達到了每秒 3,400 個輸出令牌的記錄,具有 100,000 個令牌的上下文,這對智能系統至關重要——這是該模型有史以來記錄的最快性能。
Groq 3 LPX 使得智能任務的編碼時間從小時縮短到幾分鐘,為代理和延遲敏感工作負載提供了比最近的替代平台快 4 倍的響應速度。
“推理是 AI 的增長引擎。NVIDIA Grace Blackwell 和 NVL72 以前所未有的性能和效率革命性地改變了大型語言模型的推理,” NVIDIA 創始人兼首席執行官黃仁勳表示。“Vera Rubin 擴展了這一願景,提供針對智能 AI 時代設計的工作負載優化 AI 工廠配置,通過 LPX 實現超快速的令牌生成,推動性能的前沿。這改變了智能的生產方式,帶來了 AI 吞吐量、效率和響應速度的又一次巨大飛躍,正如全球對 AI 計算的需求正在加速。”
Groq 3 LPX — 互動 AI 推理加速器
智能 AI 產生了兩個獨特的計算挑戰:高效處理大量上下文和以極低延遲生成令牌。
NVIDIA Groq 3 LPX 專為擴展 Vera Rubin 的互動性而設計——即為單個用户生成令牌的速率,決定了代理完成每一步工作的速度。
更快的生成使代理有更多時間檢查文件、編寫和測試代碼、調用工具、驗證結果並迭代,同時保持響應的用户體驗。
Groq 3 LPX 的 AI 雲勢頭
AI 雲正在成為 AI 經濟的引擎,為企業和開發者提供先進的基礎設施,以大規模進行訓練、推理和推理。對於服務延遲敏感、高容量推理工作負載的提供商,NVIDIA Groq 3 LPX 提供了一條在經過驗證的機架規模系統中部署差異化計算的路徑。
作為領先的 AI 雲,Nebius 計劃將 NVIDIA Groq 3 LPX 引入 Nebius Token Factory,其生產推理平台,為開發者提供極快的令牌生成速度,以支持高度響應的智能 AI 應用。
“生成是推理的階段,決定了 AI 系統的響應速度,而這正是 NVIDIA Groq 3 LPX 的加速目標,” Nebius 首席技術官 Danila Shtan 説。“作為首個通過 Nebius Token Factory 將其投入生產的 AI 雲,我們確保代理循環的每一步都感覺瞬時——通過開發者已經使用的相同 API,無需遷移到新的技術棧。”
在 Nebius 之後,專為 AI 推理設計的雲 Groq 計劃成為該平台的最早採用者之一。
極端協同設計的 AI 工廠
通過在七個芯片和五個專用機架之間進行極端協同設計,NVIDIA Vera Rubin 是最廣泛的 AI 工廠平台。
NVIDIA Vera Rubin NVL72 和 Groq 3 LPX 處理客户 AI 工廠的各種工作負載需求,包括前沿模型製造商和開放模型服務提供商。
這些機架平台配備 NVIDIA BlueField®-4 DPUs,並與 NVIDIA Vera CPU 機架、NVIDIA Vera BlueField-4 STX 存儲和 NVIDIA Spectrum™-6 SPX 以太網結合使用,以優化多代理系統,實現每瓦特最高吞吐量和最低延遲推理。
關於 NVIDIA
NVIDIA(納斯達克:NVDA)是全球 AI 和加速計算的領導者。
如需更多信息,請聯繫:
Alex Shapiro
企業傳播部
NVIDIA 公司
press@nvidia.com
本新聞稿中的某些聲明,包括但不限於關於:對 NVIDIA 產品、服務和技術的增長、表現、可用性和收益的預期,以及相關趨勢和驅動因素;對 NVIDIA 與第三方的安排的預期,包括與其合作者和合作夥伴的關係;對技術發展的預期,以及相關趨勢和驅動因素;市場增長和趨勢的預測;對人工智能及相關行業的預期;以及其他非歷史事實的聲明,均為前瞻性聲明,符合 1933 年證券法第 27A 條及 1934 年證券交易法第 21E 條的定義,這些聲明基於管理層的信念和假設以及當前可用的信息,並受到這些條款所創造的 “安全港” 的保護,面臨可能導致結果與預期有重大差異的風險和不確定性。可能導致實際結果與預期有重大差異的重要因素包括:全球經濟和政治狀況;NVIDIA 對第三方製造、組裝、包裝和測試其產品的依賴;技術發展和競爭的影響;新產品和技術的開發或對 NVIDIA 現有產品和技術的增強;市場對 NVIDIA 產品或其合作伙伴產品的接受度;設計、製造或軟件缺陷;消費者偏好或需求的變化;行業標準和接口的變化;NVIDIA 產品或技術在系統集成時意外的性能損失;NVIDIA 實現商業投資或收購潛在收益的能力;以及適用法律法規的變化,以及其他在 NVIDIA 定期向證券交易委員會(SEC)提交的最新報告中詳細列出的因素,包括但不限於其 10-K 表格的年度報告和 10-Q 表格的季度報告。提交給 SEC 的報告副本已在 NVIDIA 網站上發佈,並可免費從 NVIDIA 獲取。這些前瞻性聲明並不保證未來的表現,僅在本聲明日期有效,除法律要求外,NVIDIA 不承擔更新這些前瞻性聲明以反映未來事件或情況的義務。
此處描述的許多產品和功能仍處於不同階段,將在可用時提供。上述聲明並不旨在被視為承諾、保證或法律義務,任何描述的產品功能或特性的開發、發佈和時間均可能發生變化,且完全由 NVIDIA 自行決定。NVIDIA 對未能交付或延遲交付此處列出的任何產品、功能或特性不承擔任何責任。
© 2026 NVIDIA Corporation。保留所有權利。NVIDIA、NVIDIA 標誌、BlueField 和 NVIDIA Spectrum 是 NVIDIA Corporation 在美國及其他國家的商標和/或註冊商標。Groq 和 LPU 在 Groq, Inc.的許可下使用。其他公司和產品名稱可能是其相關公司的商標。特性、定價、可用性和規格如有變更,恕不另行通知。
與本公告相關的照片可在 https://www.globenewswire.com/NewsRoom/AttachmentNg/f9f9a4ac-5592-4829-b98f-898c29c59625 獲取。

