跳到正文
Hugging Face Daily Papers·· 21 天前AI 评分49

Dynin-Robotics:全模态统一扩散视觉-语言-动作模型

Dynin-Robotics: Omnimodal Unified Diffusion Vision-Language-Action Model

阅读原文

本站未展示全文,请前往来源网站阅读。

AI 导读

Dynin-Robotics 将视觉目标与动态预测引入动作生成,基于全模态掩码扩散骨干 Dynin-Omni 统一建模语言、视觉观测、目标与动作。

来源:Hugging Face Daily Papers · arxiv.org