LLaDA-Image:用完全开源训练配方构建强图像生成器
LLaDA-Image: Building Strong Image Generators with Fully Open Training Recipes
阅读原文
本站未展示全文,请前往来源网站阅读。
AI 导读
LLaDA-Image 是一个统一框架,将 6B DiT 从零训练与基于 LLaDA2.0-Mini 扩散语言模型骨干的冻结视觉语言理解模块配对。其生成管线包含 220M 样本,采用无参数 RMSNorm 与 Muon 优化器,蒸馏版 LLaDA-Image-Turbo 可在 2-4 步采样内完成推理。
来源:Hugging Face Daily Papers · arxiv.org