跳到正文
Hugging Face Daily Papers·· 1 天前AI 评分35

面向扩散语言模型的表示空间 MMD 后训练方法

Representation-Space MMD for Diffusion Language Models

阅读原文

本站未展示全文,请前往来源网站阅读。

AI 导读

研究者提出一种扩散语言模型(DLM)后训练方法,在冻结预训练 DLM 的特征空间中最小化生成分布与参考分布的 MMD,通过保留各 token 位置的上下文特征,单次提取即可获得每条序列的多个观测。

来源:Hugging Face Daily Papers · arxiv.org