AI 为什么总在画美女:从 Lena 测试图到平均脸与点击反馈循环
极客公园文章梳理了 AI 图像默认生成美女的三层成因:1973 年 Lena 图像成为行业测试标准;生成模型天生取数据分布中心,而平均脸恰好符合人类审美偏好;用户点击与 PickScore 等打分模型的反馈循环进一步强化该倾向。
推荐理由:文章从 Lena 测试图讲到平均脸研究与 reward model 反馈循环,为 AI 美女现象提供了一条可追溯的成因链条。
AI 画图的最前线:文生图模型迭代、图像编辑能力与创作工具生态的全部动态。
当前仅显示精选新闻极客公园文章梳理了 AI 图像默认生成美女的三层成因:1973 年 Lena 图像成为行业测试标准;生成模型天生取数据分布中心,而平均脸恰好符合人类审美偏好;用户点击与 PickScore 等打分模型的反馈循环进一步强化该倾向。
推荐理由:文章从 Lena 测试图讲到平均脸研究与 reward model 反馈循环,为 AI 美女现象提供了一条可追溯的成因链条。
推荐理由:独立评测方自托管实测两个图像榜单排名,并对比上一代和同类开源模型,读者可了解其在开源阵营中的位置。
Krea 宣布 FLUX 3 Image 现已上线,支持在不改变其他像素的前提下进行多轮编辑、用 bounding boxes 排版图像、生成最高 4K 分辨率,并支持使用最多 10 张参考图合成。
推荐理由:原文列出了 FLUX 3 Image 在 Krea 上的具体新能力,如多轮编辑与 10 参考图合成,读者可据此判断是否替换现有图像工作流。
Introducing FLUX 3 Image. Control every pixel. Make precise multi-turn edits without changing any other pixel. Lay out the image exactly how you want using bounding boxes. Generate in up to 4K to preserve details. Use up to 10 references to compose an image. Commercial Weights available for companies running image generation at scale. Open Weights version of FLUX 3 Image is launching in the coming weeks.
推荐理由:原文给出 FLUX 3 Image 的多轮编辑、边界框布局和 4K 输出等具体能力,并说明已上线 OpenRouter。
Runway 发布新产品 Runway Ads,连接广告账户和品牌套件后可生成视频与图像广告创意,直接发布到 Meta、Google 和 TikTok,并读取平台表现数据迭代下一轮创意。
推荐理由:Runway 官方发布并给出自身投放数据,读者可以据此评估端到端生成式投放工具对营销工作流的实际改变。
数字生命卡兹克整理了用 GPT-Image 2.5 编辑旅行照片的 12 种玩法,并附上全部可复制的提示词。玩法分三类:消除背景游客、自动调光、专业美颜等基础编辑;拍立得 3D 公仔、明信片、贴纸、行李箱拼贴、旅行海报等创意出片;以及演唱会氛围感照片、美食飞溅、文字涂鸦、ins 风画面注释等网感大片。
推荐理由:作者亲测GPT-Image 2.5整理出12个照片编辑玩法并附完整提示词,读者可以直接复制复用到自己的假期照片上。
Runway 发布 DaVinci Resolve 插件,用户可在 Resolve Studio 内直接生成图像和视频、重绘播放头所在片段,结果自动导入 Media Pool 并上到时间线。
推荐理由:原文说明了插件在剪辑流程内生成和重绘的具体用法与付费条件,剪辑用户可据此判断是否改变现有工作流。
Qwen-Image-2.1 by @Alibaba_Qwen just landed as the #1 open source model in the Image Edit Arena and Text-to-Image Arena! With 1367 pts in the Image Edit Arena, Qwen-Image-2.1 took the #1 spot among open. It landed #16 overall, just 3 pts from GPT-Image-1.5-high-fidelity at #15. See the leaderboard for the Text-to-Image arena below. Congrats to the @Alibaba_Qwen team on this contribution to the open source ecosystem!
推荐理由:官方确认 Qwen-Image-2.1 登顶两个图像 Arena 的开源榜首,榜单分数可用于同类模型的横向比较。
Qwen Image 2.1 is here! 🖼️ A 7B params native image generation and editing model, with up to 10 image references The model comes with it's own prompt enhancement LLMs, integrated with diffusers 🧨 and ComfyUI ▶️ on Spaces https://huggingface.co/spaces/hugging-apps/qwen-image-2-1
推荐理由:官方宣布生成与编辑共用单一 checkpoint,并提供浏览器免安装的 Spaces 演示,读者可直接上手体验。
Qwen-Image-2.1 is now supported in ComfyUI! Open weights. One 7B checkpoint that generates and edits. → Image generation at native 2K → Instruction editing from up to 10 reference images in a single pass → RGBA output, alpha included
推荐理由:原文列出了原生 2K 生成、多参考图编辑等具体能力,读者可以据此判断是否迁移到 ComfyUI 工作流。
OpenRouter 用同一提示词实测20个图像生成模型的真实计费,1024x1024 单张图价格在 $0.006(openai/gpt-image-2)到 $0.1344(google/gemini-3-pro-image)之间,相差22倍。
推荐理由:原文用统一提示词实测20个图像模型的实际计费,给出按任务选模型的结论,比照牌价更可靠。
Artificial Analysis 的图像编辑 arena 显示,GPT Image 2.5 Sunburst 在 7 项编辑动作中领先 6 项,并在 10 个用例中领先 8 个。




推荐理由:榜单显示图像编辑的动作领先权从五家分散收拢到单一模型,可用于比较各家编辑能力分布。
OpenAI 发布 GPT Image 2.5 的 Flare 和 Sunburst 两款图像模型,在 Artificial Analysis 图像榜单包揽文生图与图像编辑的前两名。
推荐理由:评测显示两款新模型在文生图与图像编辑榜单占据前两位,输出价格与 GPT Image 2 持平。
推荐理由:原文列出局部对象编辑、图中文字修改与多人协作等能力,读者可据此判断它在现有图像工作流中的位置。
Hugging Face 团队用 gr.Workflow 将 AUTOMATIC1111 的主要功能重建为 Workflow1111,画布包含 11 条媒体管线。
推荐理由:原文拆解了 11 条媒体管线和 73 个节点的具体构成,展示了 Gradio Workflow 混搭多模型并自动生成 REST 与 MCP 端点的做法。
推荐理由:两款图像模型分别面向速度批量与精确编辑,接入 Luma Agents 后可继续生成视频。
Runway 发布 Runway Plugins,推出面向 Premiere Pro 和 After Effects 的 Adobe 插件,在时间线内直接生成图像和视频、重绘素材并放置结果,无需导出再导入。
推荐理由:官方说明插件如何消除剪辑中反复导出导入的流程,生成结果直接落入时间线并沿用现有套餐额度。
推荐理由:官方给出图像模型在 ChatGPT 全端上线及 API 两款新模型的定位差异,读者可据此判断创作与开发选型。
Microsoft 于 9 月 4 日发布 MAI-Image-2.6,并面向 Microsoft Foundry 开发者推出低延迟版本 MAI-Image-2.6-Flash。
推荐理由:原文来自官方发布,给出排名、速度和价格效率数据,读者可据此评估两个版本在生产场景中的取舍。
inclusionAI 发布 LLaDA-Image 系列统一图像生成与编辑模型,包含 50 步 Base 版和 4 步蒸馏 Turbo 版,均为 6B 参数,并同步开放权重与 Diffusers 推理代码。
推荐理由:开源了 6B 参数统一图像生成与编辑模型,Base 与 4 步蒸馏 Turbo 两个版本都放出了权重和推理代码。