在 AI 基础设施峰会上,英伟达展示面向 AI 工厂的 DSX MaxLPS 功耗调度系统,可使每兆瓦 token 吞吐量最高提升 40%。该技术已由 Emerald AI 集成至 Conductor 平台,其 DSX Flex 可依电网状态动态调整数据中心用电需求,已接收 200 次电网状态信号且无需用户干预,Lambda 测试后在固定功率预算下 token 吞吐量提升 24%。此外,英伟达披露 Vera Rubin 和 Groq 3 LPX 机架在相同站点功耗范围内,GPU 数量最多可增 40%,token 吞吐量最多提升 35%,Groq 3 LPX 在特定工作负载中达到每位用户每秒 2529 个输出 token。多家企业测试 Vera CPU,结果显示性能、吞吐量、查询任务吞吐量等均获大幅提升,不同企业测试还测得安全沙箱启动速度、编排步骤延迟、延迟、分析查询性能等方面的显著优化。