NVIDIA Groq 3 LPX 全面投产,Vera Rubin 扩展面向智能体的推理能力
With Groq 3 LPX in Full Production, NVIDIA Extends Vera Rubin Inference for Agents
阅读原文
本站未展示全文,请前往来源网站阅读。
AI 导读
NVIDIA 宣布 Groq 3 LPX 全面投产,作为 Vera Rubin NVL72 的扩展,为智能体系统提供快速 token 生成。在 Gemma 4 31B 的 Artificial Analysis 基准测试中,其 100,000-token 长上下文场景输出速度达 3,400 tokens/秒,是最接近替代平台的 4 倍。
来源:NVIDIA Blog · blogs.nvidia.com