英伟达DSX MaxLPS榨干每瓦电力,AI工厂吞吐量飙升!
How NVIDIA DSX MaxLPS Maximizes AI Factory Throughput and Efficiency
NVIDIA Developer Blog 重要 算力商业化 🕐 今天 09:00

📖 AI 总结

NVIDIA DSX MaxLPS 通过策略驱动的动态功率共享,在既定电力预算内实现更高密度的 GPU 部署。NVIDIA 与 Nscale 在冰岛 Keflavík 的 Verne 数据中心开展联合评估,基于 NVIDIA GB300 NVL72 系统运行 Kimi K2.5 工作负载,在相同的 264.4 kW 电力预算下,将静态配置的 140 块 GPU 提升至 192 块。结果显示,归一化聚合吞吐量提升 49.2%,每瓦吞吐量从 4.10 提升至 6.12 tokens/s/W,而高吞吐与低延迟场景下的单实例吞吐基本持平。中位数与 P75 延迟保持在基线 5% 以内,但 P99 首 token 时间增加 17%,表明在追求容量收益时需同步评估尾部延迟。文章还提出五阶段验证流程,帮助运维方在规模化部署前确认电力与性能目标。

🔍 深度解读 换个视角,同一件事有不同答案

正在读取芙娘的解读…
infoAI 公众号二维码

📱 每天一份 AI 前沿日报

关注公众号,每天 09:00 推送 · 不错过任何重磅