跳到正文
Hugging Face Daily Papers·· 2026-08-28AI 评分51

Zero-WAM:用人类视频做上下文世界动作建模,实现开放任务泛化

Zero-WAM: In-Context World-Action Modeling from Human Videos for Open-Ended Task Generalization

阅读原文

本站未展示全文,请前往来源网站阅读。

AI 导读

Zero-WAM 是一个因果视频-动作模型,通过上下文人类视频引导执行训练中未见过的机器人操作任务,在 RoboTwin 2.0 仿真的七个未见任务上取得 47.0% 平均成功率,比最强视频-动作基线高 29.5 个百分点。

来源:Hugging Face Daily Papers · arxiv.org