NVIDIA 在其技术博客中阐述了 Vera Rubin 平台如何以每瓦性能作为 AI 工厂价值的核心衡量标准。文章指出,Vera Rubin NVL72 在从大批量吞吐到高交互小批量等多样化 AI 计算场景下均能提供出色的能效表现。工厂级 DSX MaxLPS 软件可在机架间动态调配电力,回收闲置容量,在相同功耗预算内实现最多 40% 的 GPU 增量和 35% 的 token 吞吐提升;机架级电容与智能功率平滑技术则可吸收突发功率尖峰,使规划基于持续需求而非最坏峰值。关键发现来自 Groq 3 LPX 的确定性执行模型:它实现了全部 256 颗 LPU 芯片计算与数据搬运的周期精确调度,配合抢占式功率与时钟周期合成技术,利用可预测的电流需求曲线将电压跌落降低逾 60%,并收窄电压保护带,在相同负载下实现低两位数百分比的功耗下降。将 Groq 3 LPX 与 Vera Rubin NVL72 搭配,在 2T 以上参数模型、长上下文和高交互场景下,每兆瓦吞吐量可达上一代 GB200 NVL72 的 35 倍。这一成果表明,确定性执行正成为兼顾能效与高交互推理的关键路径。
📱 每天一份 AI 前沿日报
关注公众号,每天 09:00 推送 · 不错过任何重磅