VidaForge:面向视频预训练数据配方的开放研究基础设施
VidaForge: Open Research Infrastructure for Video Pretraining Data Recipes
阅读原文
本站未展示全文,请前往来源网站阅读。
AI 导读
VidaForge 将视频数据配方表示为从原始视频到训练数据集的可执行五阶段工作流,并开源含 314 万个场景级片段、共 6475 小时的 VidaForge-3M 数据集。在 Wan 2.1 与 V-JEPA 2.1 的早期从零预训练对比中,覆盖更广的配方在下游基准上得分最高,而基于 loss 的评估则偏好不同配方。
来源:Hugging Face Daily Papers · arxiv.org