Dynin-Robotics:全模态统一扩散视觉-语言-动作模型
Dynin-Robotics: Omnimodal Unified Diffusion Vision-Language-Action Model
阅读原文
本站未展示全文,请前往来源网站阅读。
AI 导读
Dynin-Robotics 将视觉目标与动态预测引入动作生成,基于全模态掩码扩散骨干 Dynin-Omni 统一建模语言、视觉观测、目标与动作。
来源:Hugging Face Daily Papers · arxiv.org