跳到正文
Hugging Face Daily Papers·· 27 天前AI 评分51

TANGO:面向杂乱环境人形导航的全身视觉-语言-动作框架

TANGO: Humanoid Navigation in Cluttered Environments with a Whole-Body Vision-Language-Action Model

阅读原文

本站未展示全文,请前往来源网站阅读。

AI 导读

研究者提出 TANGO,一个面向杂乱环境语言引导人形穿越的全身视觉-语言-动作框架,输入自然语言指令与自我中心 RGB 观测后直接预测 29-DoF 关节空间动作。

来源:Hugging Face Daily Papers · arxiv.org