SemComp-Bench:视频生成中的语义任务完成基准测试
SemComp-Bench: Benchmarking Semantic Task Completion in Video Generation
阅读原文
本站未展示全文,请前往来源网站阅读。
AI 导读
研究者提出语义任务完成视频生成任务,并构建覆盖六个领域的评估数据集 SemComp-Data 与评估协议 SemComp-Bench,后者用 VLM 回答结构化二值问题,分别报告 Outcome Achievement 的 OA Score 和 Generation Reliability 的 GR Score。
来源:Hugging Face Daily Papers · arxiv.org