SemVID 提出三类视觉 Token 分配,解决高压缩下时序碎片化 | ECCV'26
三类视觉Token分配,能直接解决高压缩时序碎片化 | ECCV‘26
阅读原文
本站未展示全文,请前往来源网站阅读。
AI 导读
被 ECCV 2026 录用的 SemVID 提出一种 training-free token 剪枝框架,通过显式保留 Object、Motion、Context 三类语义角色 token 来维持支撑视频时序定位(VTG)的证据链。
来源:量子位 · 微信公众号 · mp.weixin.qq.com