跳到正文
@AntLingAGI· @AntLingAGI · X·· 2026-08-22AI 评分39
AI 导读

今天我们开源了 Ling-3.0-flash-dspark,这是一个专为 Ling-3.0-flash 构建的 DSpark 草稿模型。 在 4 块 NVIDIA Blackwell GPU 上、batch 1 条件下,它在 1,000 个请求中实现了 1,120 tok/s、0.78 ms 平均 TPOT,以及 9.95 的接受长度。🧵 https://t.co/7sDr7wy0rO

正文

Today we are open sourcing Ling-3.0-flash-dspark, a DSpark draft model built specifically for Ling-3.0-flash.
On 4 NVIDIA Blackwell GPUs at batch 1, it delivered 1,120 tok/s, 0.78 ms mean TPOT, and an accept length of 9.95 across 1,000 requests. 🧵 https://t.co/7sDr7wy0rO

来源:@AntLingAGI · x.com