LightNav-0:激发 VLM 空间智能的通用具身导航模型
LightNav-0: Eliciting VLM Spatial Intelligence for Generalist Embodied Navigation
阅读原文
本站未展示全文,请前往来源网站阅读。
AI 导读
LightNav-0 是一款紧凑的通用具身导航模型,通过统一 token 接口激发预训练 VLM 的空间智能,无需任务专用预测头。其导航训练语料覆盖 2K+ 场景和 4K+ 小时具身导航数据,在全部 10 个公开导航仿真设置中取得 SOTA 单目成功率,并实现跨机器人本体的零样本泛化。
来源:Hugging Face Daily Papers · arxiv.org