智能体化视觉生成:从生成模型到智能体控制
Agentic Visual Generation: From Generative Models to Agentic Control
阅读原文
本站未展示全文,请前往来源网站阅读。
AI 导读
一篇综述提出按控制器对生成过程的直接控制范围划分智能体化视觉生成:L1 条件控制、L2 执行控制、L3 结果自适应控制、L4 经验自适应控制,L0 则指无控制器的固定生成器、编辑器、评估器、奖励模型、基准与流水线。该框架强调这些层级描述的是决策范围逐步扩大,而非模型规模、系统复杂度、输出质量、工具或角色数量或训练方法,并据此梳理图像、视频、编辑、3D、世界、幻灯片与用户界面生成中控制器能力的演进。
来源:Hugging Face Daily Papers · arxiv.org