📢 首次在硅片上實測英偉達 Vera Rubin 性能,評估智能體(Agents)的實際運行表現。
⚡ 與 GB300 NVL72 相比,每兆瓦吞吐量最高提升 30 倍,Token 成本降低高達 35 倍。智能體會話與聊天或摘要工作負載截然不同。上下文會在數百個步驟中累積,可能達到數十萬個 Token。英偉達在 @SemiAnalysis_ AgentX 工作負載上對 Vera Rubin 性能進行了測量,該負載使用 DeepSeek V4 Pro 模型包含真實的智能體編碼軌跡。來源:NVIDIA_X


