3.125-Bit LLM 量化绕过 Tensor Core
3.125-Bit LLM quantization bypassing tensor cores
阅读原文
本站未展示全文,请前往来源网站阅读。
AI 导读
一项 3.125-Bit LLM 量化方案通过绕过 Tensor Core 实现。该方案未使用 Tensor Core 进行矩阵运算,具体模型、参数规模与性能数据尚未披露。
来源:blog.djellalmohamedaniss.workers.dev(经 Hacker News) · blog.djellalmohamedaniss.workers.dev