打破视觉-动作捷径:面向可泛化机器人基础模型的 Latent Interface Training
Breaking the Vision-Action Shortcut: Latent Interface Training for Generalizable Robotics Foundation Models
阅读原文
本站未展示全文,请前往来源网站阅读。
AI 导读
研究者提出 Latent Interface Training(LIT),一种与框架无关的两阶段策略,先在不使用图像的情况下建立以空间目标为条件的动作先验,再通过姿态监督的 latent interface 约束视觉条件路径。
来源:Hugging Face Daily Papers · arxiv.org