Nvidia 称 Groq 3 LPX 推理速度是 Cerebras 四倍,但算法没那么简单
Nvidia says its Groq 3 LPX is four times faster than Cerebras, but the math is more complicated
阅读原文
本站未展示全文,请前往来源网站阅读。
AI 导读
Nvidia 将 Groq 3 LPX 推理芯片推入全面量产,称其在 Gemma 4 31B 上达到 3400 tokens/秒,比 Cerebras 快四倍。但该成绩需至少 64 块加速器,而 Cerebras 仅需一到两块;该架构在大型 MoE 模型上的扩展性仍是未知数。
来源:The Decoder · the-decoder.com