Daedalus-150M:面向 CPU 推理的卷积-注意力混合模型
Daedalus-150M: A Convolution-Attention Hybrid Designed for CPU Inference
阅读原文
本站未展示全文,请前往来源网站阅读。
AI 导读
Daedalus-150M 是一个为 CPU 推理设计的卷积-注意力混合小模型,18 个 block 中仅 6 个保留完整注意力,其余 12 个使用短卷积,内存宽度固定为两个时间步。
来源:Hugging Face Daily Papers · arxiv.org