跳到正文
热点事件持续更新

llama.cpp v0.6.0 支持 Qwen3.8-27B DFlash 加速

2 篇报道1 个报道来源2 小时前更新

先了解这件事

AI 综述

2026年10月6日,llama.cpp 维护者 Georgi Gerganov 宣布发布 v0.6.0,新增 Clef 支持(文本与视觉)、对 Qwen3.8-Flash-Next 的高质量支持、Metal 大幅性能提升以及新的 llama_batch_ext API,网站 llama.app 同步改版。同日稍晚,他进一步表示 llama.cpp 已支持 Qwen3.8-27B DFlash 加速,建议使用 Qwen3.8-27B 与 MTP 的用户升级到 DFlash 以获得额外加速,并给出命令 llama serve -hf ggml-org/Qwen3.8-27B-GGUF --spec-type draft-dflash --spec-draft-n-max 7,同时强调需要最新的 llama.cpp v0.6.0。

AI 根据报道生成 · 2 小时前更新

事件进展

2 个进展
  1. 10月6日 21:27 · 1 篇报道
    llama.cpp v0.6.0支持Qwen3.8-27B DFlash加速
    Georgi Gerganov (@ggerganov) · X:llama.cpp 支持 Qwen3.8-27B DFlash 加速
  2. 10月6日 03:24 · 1 篇报道
    llama.cpp v0.6.0 发布
    Georgi Gerganov (@ggerganov) · X:llama.cpp 发布 v0.6.0:新增 Clef 支持并大幅提升 Metal 性能

报道时间线

沿着报道,了解事件的不同侧面。

10月6日
  1. Georgi Gerganov (@ggerganov) · X
    llama.cpp 支持 Qwen3.8-27B DFlash 加速

    如果你在使用 Qwen3.8-27B + MTP,请务必升级到 DFlash 以获得额外加速: llama serve -hf ggml-org/Qwen3.8-27B-GGUF --spec-type draft-dflash --spec-draft-n-max 7 需要最新的 llama.cpp v0.6.0

  2. Georgi Gerganov (@ggerganov) · X
    llama.cpp 发布 v0.6.0:新增 Clef 支持并大幅提升 Metal 性能

    llama.cpp 维护者 Georgi Gerganov 宣布 v0.6.0 发布,包含 Clef 支持(文本+视觉)、对 Qwen3.8-Flash-Next 的高质量支持、Metal 大幅性能提升和新 llama_batch_ext API,网站 llama.app 也同步改版。

本事件热度走势

还没有足够的连续观测数据,暂不绘制趋势。