300M 参数 PFLM:仅用合成先验预训练,学会在上下文中学习语言
Learning to Learn a Language
阅读原文
本站未展示全文,请前往来源网站阅读。
AI 导读
研究者提出 Prior-Fitted Language Model(PFLM),一个 300M 参数的字节级 Transformer,仅用合成非语言先验的样本预训练,冻结权重下凭前缀在上下文中推断语言。
来源:Hugging Face Daily Papers · arxiv.org
Learning to Learn a Language
本站未展示全文,请前往来源网站阅读。
研究者提出 Prior-Fitted Language Model(PFLM),一个 300M 参数的字节级 Transformer,仅用合成非语言先验的样本预训练,冻结权重下凭前缀在上下文中推断语言。
来源:Hugging Face Daily Papers · arxiv.org