NVIDIA Groq 3 LPX 现已全面投产,以世界级速度支持 Agentic AI | NVDA 股票新闻
我是 LongbridgeAI,我可以总结文章信息。NVIDIA 宣布其 Groq 3 LPX 互动 AI 推理加速器现已全面投入生产。作为 Vera Rubin 平台的扩展,它为自主 AI 系统提供超快速的令牌生成。Nebius 是首个采用该技术的 AI 云,旨在为对延迟敏感的工作负载提供极致速度。该芯片在基准测试中取得了创纪录的性能,显著提升了复杂代理任务的响应能力
在 Google 搜索和 AI 答案中查看更多来自 StockTitan 的信息。将 StockTitan 添加为首选来源 · 打开 Google
在 Google 上添加
Groq 3 LPX 扩展了 Vera Rubin 平台,为下一代智能 AI 提供超快速的令牌生成,Nebius 是首个采用该技术的
新闻摘要:
- 在人工分析基准测试中,Groq 3 LPX 展示了世界级的智能编码和其他延迟敏感工作负载的速度。
- NVIDIA Groq 3 LPX 通过显著提高令牌生成速率,扩展了 NVIDIA Vera Rubin NVL72 系统的推理性能。
- Nebius 是首个采用 NVIDIA Groq 3 LPX 的 AI 云。
加利福尼亚州帕洛阿尔托,2026 年 8 月 24 日(GLOBE NEWSWIRE)-- Hot Chips— NVIDIA 今天宣布,NVIDIA Groq 3 LPX,这款互动 AI 推理加速器,现已全面投入生产。作为 NVIDIA Vera Rubin 平台的扩展,Groq 3 LPX 通过实现超快速的令牌生成,为高度响应的智能系统提供了重大提升。
智能系统可以在数百或数千个推理步骤中生成大量令牌,因此更快的令牌生成对于代理进行推理、行动和实时完成复杂任务至关重要。
Vera Rubin NVL72 系统为每个 AI 工厂提供了最通用的训练和推理平台。NVIDIA Groq 3 LPX 通过显著提高令牌生成速率,扩展了 Vera Rubin NVL72 的推理性能,为上下文密集型工作负载提供优质用户体验,使代理能够以极快的速度行动。
NVIDIA Groq 3 LPX 正在推动 AI 推理的前沿。在人工分析基准测试中,它在运行 Gemma 4 31B(一个开源智能模型)时,达到了每秒 3,400 个输出令牌的记录,具有 100,000 个令牌的上下文,这对智能系统至关重要——这是该模型有史以来记录的最快性能。
Groq 3 LPX 使得智能任务的编码时间从小时缩短到几分钟,为代理和延迟敏感工作负载提供了比最近的替代平台快 4 倍的响应速度。
“推理是 AI 的增长引擎。NVIDIA Grace Blackwell 和 NVL72 以前所未有的性能和效率革命性地改变了大型语言模型的推理,” NVIDIA 创始人兼首席执行官黄仁勋表示。“Vera Rubin 扩展了这一愿景,提供针对智能 AI 时代设计的工作负载优化 AI 工厂配置,通过 LPX 实现超快速的令牌生成,推动性能的前沿。这改变了智能的生产方式,带来了 AI 吞吐量、效率和响应速度的又一次巨大飞跃,正如全球对 AI 计算的需求正在加速。”
Groq 3 LPX — 互动 AI 推理加速器
智能 AI 产生了两个独特的计算挑战:高效处理大量上下文和以极低延迟生成令牌。
NVIDIA Groq 3 LPX 专为扩展 Vera Rubin 的互动性而设计——即为单个用户生成令牌的速率,决定了代理完成每一步工作的速度。
更快的生成使代理有更多时间检查文件、编写和测试代码、调用工具、验证结果并迭代,同时保持响应的用户体验。
Groq 3 LPX 的 AI 云势头
AI 云正在成为 AI 经济的引擎,为企业和开发者提供先进的基础设施,以大规模进行训练、推理和推理。对于服务延迟敏感、高容量推理工作负载的提供商,NVIDIA Groq 3 LPX 提供了一条在经过验证的机架规模系统中部署差异化计算的路径。
作为领先的 AI 云,Nebius 计划将 NVIDIA Groq 3 LPX 引入 Nebius Token Factory,其生产推理平台,为开发者提供极快的令牌生成速度,以支持高度响应的智能 AI 应用。
“生成是推理的阶段,决定了 AI 系统的响应速度,而这正是 NVIDIA Groq 3 LPX 的加速目标,” Nebius 首席技术官 Danila Shtan 说。“作为首个通过 Nebius Token Factory 将其投入生产的 AI 云,我们确保代理循环的每一步都感觉瞬时——通过开发者已经使用的相同 API,无需迁移到新的技术栈。”
在 Nebius 之后,专为 AI 推理设计的云 Groq 计划成为该平台的最早采用者之一。
极端协同设计的 AI 工厂
通过在七个芯片和五个专用机架之间进行极端协同设计,NVIDIA Vera Rubin 是最广泛的 AI 工厂平台。
NVIDIA Vera Rubin NVL72 和 Groq 3 LPX 处理客户 AI 工厂的各种工作负载需求,包括前沿模型制造商和开放模型服务提供商。
这些机架平台配备 NVIDIA BlueField®-4 DPUs,并与 NVIDIA Vera CPU 机架、NVIDIA Vera BlueField-4 STX 存储和 NVIDIA Spectrum™-6 SPX 以太网结合使用,以优化多代理系统,实现每瓦特最高吞吐量和最低延迟推理。
关于 NVIDIA
NVIDIA(纳斯达克:NVDA)是全球 AI 和加速计算的领导者。
如需更多信息,请联系:
Alex Shapiro
企业传播部
NVIDIA 公司
press@nvidia.com
本新闻稿中的某些声明,包括但不限于关于:对 NVIDIA 产品、服务和技术的增长、表现、可用性和收益的预期,以及相关趋势和驱动因素;对 NVIDIA 与第三方的安排的预期,包括与其合作者和合作伙伴的关系;对技术发展的预期,以及相关趋势和驱动因素;市场增长和趋势的预测;对人工智能及相关行业的预期;以及其他非历史事实的声明,均为前瞻性声明,符合 1933 年证券法第 27A 条及 1934 年证券交易法第 21E 条的定义,这些声明基于管理层的信念和假设以及当前可用的信息,并受到这些条款所创造的 “安全港” 的保护,面临可能导致结果与预期有重大差异的风险和不确定性。可能导致实际结果与预期有重大差异的重要因素包括:全球经济和政治状况;NVIDIA 对第三方制造、组装、包装和测试其产品的依赖;技术发展和竞争的影响;新产品和技术的开发或对 NVIDIA 现有产品和技术的增强;市场对 NVIDIA 产品或其合作伙伴产品的接受度;设计、制造或软件缺陷;消费者偏好或需求的变化;行业标准和接口的变化;NVIDIA 产品或技术在系统集成时意外的性能损失;NVIDIA 实现商业投资或收购潜在收益的能力;以及适用法律法规的变化,以及其他在 NVIDIA 定期向证券交易委员会(SEC)提交的最新报告中详细列出的因素,包括但不限于其 10-K 表格的年度报告和 10-Q 表格的季度报告。提交给 SEC 的报告副本已在 NVIDIA 网站上发布,并可免费从 NVIDIA 获取。这些前瞻性声明并不保证未来的表现,仅在本声明日期有效,除法律要求外,NVIDIA 不承担更新这些前瞻性声明以反映未来事件或情况的义务。
此处描述的许多产品和功能仍处于不同阶段,将在可用时提供。上述声明并不旨在被视为承诺、保证或法律义务,任何描述的产品功能或特性的开发、发布和时间均可能发生变化,且完全由 NVIDIA 自行决定。NVIDIA 对未能交付或延迟交付此处列出的任何产品、功能或特性不承担任何责任。
© 2026 NVIDIA Corporation。保留所有权利。NVIDIA、NVIDIA 标志、BlueField 和 NVIDIA Spectrum 是 NVIDIA Corporation 在美国及其他国家的商标和/或注册商标。Groq 和 LPU 在 Groq, Inc.的许可下使用。其他公司和产品名称可能是其相关公司的商标。特性、定价、可用性和规格如有变更,恕不另行通知。
与本公告相关的照片可在 https://www.globenewswire.com/NewsRoom/AttachmentNg/f9f9a4ac-5592-4829-b98f-898c29c59625 获取。

