跳到正文
Hugging Face Daily Papers·· 2026-08-17AI 评分40

S²VOPD:自监督视觉同策略蒸馏,无需更强教师或特权信息

Self-Supervised Visual On-Policy Distillation

阅读原文

本站未展示全文,请前往来源网站阅读。

AI 导读

研究者提出 Self-Supervised Visual On-Policy Distillation(S²VOPD),通过从学生侧"减去"信息而非给教师添加特权信息来构造不对称学习信号,无需真值标注、奖励或独立更强教师模型。

来源:Hugging Face Daily Papers · arxiv.org