OmniTools 8月25日消息,NVIDIA 实测数据显示,Vera Rubin NVL72 在 AI 智能体工作负载下,每兆瓦吞吐量较 GB300 NVL72 最高提升 30 倍,每百万 token 计算成本降低至原方案的 1/35。 该性能提升基于 NVIDIA 对智能体典型任务场景的基准测试,涵盖推理延迟、并发请求处理及长上下文调度等维度。Vera Rubin NVL72 采用新一代架构与液冷优化设计,面向大规模智能体集群部署。