S²VOPD:自监督视觉同策略蒸馏,无需更强教师或特权信息
Self-Supervised Visual On-Policy Distillation
阅读原文
本站未展示全文,请前往来源网站阅读。
AI 导读
研究者提出 Self-Supervised Visual On-Policy Distillation(S²VOPD),通过从学生侧"减去"信息而非给教师添加特权信息来构造不对称学习信号,无需真值标注、奖励或独立更强教师模型。
来源:Hugging Face Daily Papers · arxiv.org