跳到正文
原文
LMSYS Blog· The Qwen C-end Infrastructure Engineering Team & The AMD AI Framework Team·· 2026-02-11AI 评分41

千问(Qwen)与 AMD 在 MI300X 上优化 Qwen3 与 Qwen3-VL 推理延迟

Unleashing Computational Power: Ultimate Latency Optimization of Qwen3 and Qwen3-VL on AMD MI300X Series

AI 导读

千问 C 端基础设施工程团队与 AMD AI 框架团队基于 SGLang,在 AMD Instinct MI300X 系列 GPU 上对 Qwen3-235B 和 Qwen3-VL-235B 完成极端延迟优化。

来源:LMSYS Blog · lmsys.org