TANGO:面向杂乱环境人形导航的全身视觉-语言-动作框架
TANGO: Humanoid Navigation in Cluttered Environments with a Whole-Body Vision-Language-Action Model
阅读原文
本站未展示全文,请前往来源网站阅读。
AI 导读
研究者提出 TANGO,一个面向杂乱环境语言引导人形穿越的全身视觉-语言-动作框架,输入自然语言指令与自我中心 RGB 观测后直接预测 29-DoF 关节空间动作。
来源:Hugging Face Daily Papers · arxiv.org