Dream4ACT:面向多形态机器人的共享视觉动作接口
Dream4ACT: A Shared Visual Action Interface for Multi-Embodiment Video-Action Modeling
阅读原文
本站未展示全文,请前往来源网站阅读。
AI 导读
Dream4ACT 是一个面向多形态机器人的世界模型,通过名为 action views 的共享视觉动作接口,用 URDF 正运动学从四个虚拟相机渲染目标关节构型,使观测与动作序列共享同一视频自编码器和扩散 Transformer。
来源:Hugging Face Daily Papers · arxiv.org