EditVid:一个无需训练的统一视频编辑框架,兼顾指令引导与主体引导编辑
One Editor, Many Edits: A Unified Training-Free Framework for Diverse Video Editing
阅读原文
本站未展示全文,请前往来源网站阅读。
AI 导读
EditVid 是一个无需训练的统一视频编辑框架,结合稀疏因果记忆、基于对应关系的后注意力 token 注入和软潜变量混合,同时支持指令引导与参考引导编辑。在 FiVE 上,EditVid 取得 78.16 FiVE-Acc,而最强的无需训练基线为 58.95,并在 IVEBench 上取得有竞争力的结果。用户研究显示,相较 7 种对比方法,EditVid 总体偏好度为 51.8%。
来源:Hugging Face Daily Papers · arxiv.org