OmniTools 9月16日消息,NVIDIA官方9月15日消息,英伟达在加州圣克拉拉举行的AI基础设施峰会(AI Infra Summit)上公布多项AI工厂能效技术进展。公司超算与高性能计算副总裁Ian Buck强调,AI基础设施的衡量标准正从峰值性能转向“每兆瓦生成令牌数”(tokens per megawatt),并展示了DSX MaxLPS、Vera Rubin NVL72系统及Groq 3 LPX等全栈方案以优化功耗分配。
AI云服务商Lambda现场验证了DSX MaxLPS在Blackwell服务器上的效果:在相同功率预算下,19个节点可替代原16个满载节点,集群级令牌吞吐量提升24%(达500万tokens/s),能效提升23%;在Vera Rubin NVL72部署中,该技术可于同等电力容量内增加最多40% GPU数量。
Emerald AI联合Silicon Valley Power演示了基于DSX Flex的电网响应式负载管理能力,系统可自动响应电网调峰信号,在保障关键AI任务运行前提下动态调节非优先任务功耗。此外,SemiAnalysis AgentX基准测试显示,Vera Rubin NVL72在DeepSeek V4 Pro模型上的代理式AI工作负载能效达GB300 NVL72的30倍(tokens/MW),单位令牌成本降低最高达45倍。