跳到正文
Hugging Face Daily Papers·· 7 天前AI 评分43

LVMT:面向长时视频分割的视频掩码 Transformer

LVMT: Video Mask Transformer for Long-term Video Segmentation

阅读原文

本站未展示全文,请前往来源网站阅读。

AI 导读

针对现有在线视频分割方法难以应对长视频中长期遮挡的问题,研究者提出 LVMT(Long-term Video Mask Transformer),用轻量 GRU 时序传播模块自适应选择跨时间保留的信息,并引入 Truncated Query Propagation(TQP)训练策略,分块处理视频、仅在块内反向传播,从而支持长视频训练。

来源:Hugging Face Daily Papers · arxiv.org