跳到正文
原文
Hugging Face Blog·· 2026-08-21精选AI 评分65

Liquid AI 发布 LFM2.5-DSpark 草稿模型,推理吞吐最高提升 3.2x

Up to 3.2x Faster Inference with LFM2.5-DSpark

AI 导读

Liquid AI 为 LFM2.5-1.2B-Instruct、LFM2.5-2.6B 和 LFM2.5-8B-A1B 三个模型发布 DSpark 草稿模型 checkpoint,通过投机解码在不改变输出质量的前提下加速推理,GPU 吞吐最高提升 3.18x,端侧最高 2.87x。

推荐理由

官方为 LFM2.5 三款模型发布 DSpark 草稿模型,给出从 H100 到 MacBook 的实测加速数据和开源接入方式。

来源:Hugging Face Blog · huggingface.co