OpenAI 的 Jalapeño 芯片面向规模化快速推理,基准显示每千瓦吞吐量高于现有最优方案
OpenAI’s Jalapeño chip is built for fast inference at scale, benchmarks show
阅读原文
本站未展示全文,请前往来源网站阅读。
AI 导读
OpenAI 的 Jalapeño 芯片在 SemiAnalysis 的 InferenceX 基准测试中,每用户 token 数和每千瓦吞吐量均高于当前可用的最优方案。该芯片面向规模化场景下的快速推理。
来源:TechCrunch · AI · techcrunch.com