VLAct:面向视觉-语言-动作模型的表征中心持续预训练
Beyond Data Scaling: Representation-Centric Continued Pre-training for Vision-Language-Action Models
阅读原文
本站未展示全文,请前往来源网站阅读。
AI 导读
研究团队提出 VLAct,一种面向 VLA 模型的 VLM 骨干,通过 VLM 先验保持、多头连续动作协同监督和部分统一的跨具身动作布局,在广泛异构多具身机器人数据上持续预训练。
来源:Hugging Face Daily Papers · arxiv.org