跳到正文
Hugging Face Daily Papers·· 22 天前AI 评分41

打破视觉-动作捷径:面向可泛化机器人基础模型的 Latent Interface Training

Breaking the Vision-Action Shortcut: Latent Interface Training for Generalizable Robotics Foundation Models

阅读原文

本站未展示全文,请前往来源网站阅读。

AI 导读

研究者提出 Latent Interface Training(LIT),一种与框架无关的两阶段策略,先在不使用图像的情况下建立以空间目标为条件的动作先验,再通过姿态监督的 latent interface 约束视觉条件路径。

来源:Hugging Face Daily Papers · arxiv.org