跳到正文
Hugging Face Daily Papers·· 2026-08-31AI 评分43

VLAct:面向视觉-语言-动作模型的表征中心持续预训练

Beyond Data Scaling: Representation-Centric Continued Pre-training for Vision-Language-Action Models

阅读原文

本站未展示全文,请前往来源网站阅读。

AI 导读

研究团队提出 VLAct,一种面向 VLA 模型的 VLM 骨干,通过 VLM 先验保持、多头连续动作协同监督和部分统一的跨具身动作布局,在广泛异构多具身机器人数据上持续预训练。

来源:Hugging Face Daily Papers · arxiv.org