NVIDIA 在 AI Infra Summit 展示 Vera Rubin 与 DSX 平台:以每瓦 Token 数优化 AI 工厂能效
AI Infra Summit: NVIDIA Vera Rubin and DSX Platform Advancements Showcase Energy Efficiencies of Optimizing Tokens Per Watt for AI Factories
阅读原文
本站未展示全文,请前往来源网站阅读。
AI 导读
NVIDIA 在 AI Infra Summit 上公布 Vera Rubin NVL72 首次 MLPerf Inference v6.1 预览成绩,吞吐量最高达 GB300 NVL72 的 3.7 倍;GB300 NVL72 以 288 GPU 跨四机架实现 99% 扩展效率,软件优化使 v6.1 性能较 v6.0 提升最多 1.6 倍。
来源:NVIDIA Blog · blogs.nvidia.com