跳到正文

图像生成

AI 画图的最前线:文生图模型迭代、图像编辑能力与创作工具生态的全部动态。

当前仅显示精选新闻
56条精选相关主题AI 视频多模态产品更新

最新精选

第 1–20 条 · 共 56 条
今天10月6日周二
  1. 虎嗅APP · 微信公众号65

    AI 为什么总在画美女:从 Lena 测试图到平均脸与点击反馈循环

    极客公园文章梳理了 AI 图像默认生成美女的三层成因:1973 年 Lena 图像成为行业测试标准;生成模型天生取数据分布中心,而平均脸恰好符合人类审美偏好;用户点击与 PickScore 等打分模型的反馈循环进一步强化该倾向。

    推荐理由:文章从 Lena 测试图讲到平均脸研究与 reward model 反馈循环,为 AI 美女现象提供了一条可追溯的成因链条。

10月2日周五
  1. OpenRouter66

    OpenRouter 宣布 Black Forest Labs 的新旗舰图像模型 FLUX 3 Image 已上线,支持文生图与多参考图编辑,原生最高 4K 渲染。据原模型发布信息,FLUX 3 Image 支持精确多轮编辑、用边界框控制排版、最多 10 个参考图合成图像,商业权重已开放,开放权重版本将在未来几周推出。

    引用Black Forest Labs@bfl_ai

    Introducing FLUX 3 Image. Control every pixel. Make precise multi-turn edits without changing any other pixel. Lay out the image exactly how you want using bounding boxes. Generate in up to 4K to preserve details. Use up to 10 references to compose an image. Commercial Weights available for companies running image generation at scale. Open Weights version of FLUX 3 Image is launching in the coming weeks.

    推荐理由:原文给出 FLUX 3 Image 的多轮编辑、边界框布局和 4K 输出等具体能力,并说明已上线 OpenRouter。

10月1日周四
9月28日周一
  1. 数字生命卡兹克 · 微信公众号73

    GPT-Image 2.5 的 12 种照片玩法合集:去游客、调光、海报与涂鸦提示词

    数字生命卡兹克整理了用 GPT-Image 2.5 编辑旅行照片的 12 种玩法,并附上全部可复制的提示词。玩法分三类:消除背景游客、自动调光、专业美颜等基础编辑;拍立得 3D 公仔、明信片、贴纸、行李箱拼贴、旅行海报等创意出片;以及演唱会氛围感照片、美食飞溅、文字涂鸦、ins 风画面注释等网感大片。

    推荐理由:作者亲测GPT-Image 2.5整理出12个照片编辑玩法并附完整提示词,读者可以直接复制复用到自己的假期照片上。

9月24日周四
9月23日周三
  1. Qwen66

    千问(Qwen)宣布 Qwen-Image-2.1 在 Arena 的 Image Edit 和 Text-to-Image 两个榜单均排名第一的开源模型。@arena 引用称其 Image Edit Arena 得分 1367,总排名第 16,距第 15 名 GPT-Image-1.5-high-fidelity 仅差 3 分。

    引用Arena.ai@arena

    Qwen-Image-2.1 by @Alibaba_Qwen just landed as the #1 open source model in the Image Edit Arena and Text-to-Image Arena! With 1367 pts in the Image Edit Arena, Qwen-Image-2.1 took the #1 spot among open. It landed #16 overall, just 3 pts from GPT-Image-1.5-high-fidelity at #15. See the leaderboard for the Text-to-Image arena below. Congrats to the @Alibaba_Qwen team on this contribution to the open source ecosystem!

    推荐理由:官方确认 Qwen-Image-2.1 登顶两个图像 Arena 的开源榜首,榜单分数可用于同类模型的横向比较。

9月21日周一
  1. Qwen67

    通义千问发布 Qwen-Image-2.1,可在 Hugging Face Spaces 浏览器中直接体验,无需本地配置。该模型为 7B 参数的原生图像生成与编辑模型,使用单一 checkpoint 同时支持生成和编辑,最多支持 10 张参考图,自带提示词增强 LLM,并已集成 diffusers 和 ComfyUI,演示地址为 https://huggingface.co/spaces/hugging-apps/qwen-image-2-1。

    引用Hugging Apps@HuggingApps

    Qwen Image 2.1 is here! 🖼️ A 7B params native image generation and editing model, with up to 10 image references The model comes with it's own prompt enhancement LLMs, integrated with diffusers 🧨 and ComfyUI ▶️ on Spaces https://huggingface.co/spaces/hugging-apps/qwen-image-2-1

    推荐理由:官方宣布生成与编辑共用单一 checkpoint,并提供浏览器免安装的 Spaces 演示,读者可直接上手体验。

9月20日周日
  1. Qwen66

    Qwen 官方宣布 Qwen-Image-2.1 现已支持 ComfyUI。引用内容显示该模型为开源权重,单一 7B checkpoint 即可生成和编辑图像,支持原生 2K 图像生成、单次最多 10 张参考图的指令编辑,以及带 alpha 通道的 RGBA 输出。

    引用ComfyUI@ComfyUI

    Qwen-Image-2.1 is now supported in ComfyUI! Open weights. One 7B checkpoint that generates and edits. → Image generation at native 2K → Instruction editing from up to 10 reference images in a single pass → RGBA output, alpha included

    推荐理由:原文列出了原生 2K 生成、多参考图编辑等具体能力,读者可以据此判断是否迁移到 ComfyUI 工作流。

9月18日周五
  1. OpenRouter Announcements80

    OpenRouter 实测20个图像生成模型的真实成本、编辑与质量差异

    OpenRouter 用同一提示词实测20个图像生成模型的真实计费,1024x1024 单张图价格在 $0.006(openai/gpt-image-2)到 $0.1344(google/gemini-3-pro-image)之间,相差22倍。

    推荐理由:原文用统一提示词实测20个图像模型的实际计费,给出按任务选模型的结论,比照牌价更可靠。

9月12日周六
9月10日周四
  1. @GoogleAI66

    Google 发布 Google Pics,该工具基于 Nano Banana 构建,支持生成、精修和共同创作图像,可隔离并编辑特定对象而不影响画面其余部分、直接修改或翻译图中文字、与他人共享协作同一次创作,以及从单个提示词生成多个选项。

    原始视频预览图;未保存可播放视频URL

    推荐理由:原文列出局部对象编辑、图中文字修改与多人协作等能力,读者可据此判断它在现有图像工作流中的位置。

  2. @LumaLabsAI68

    GPT-Image-2.5 已在 Luma Agents 上线,OpenAI 的 Flare 与 Sunburst 两款图像模型同日开放。Luma 称 Flare 面向速度与批量生成,Sunburst 面向需要精确落地的编辑。用户可以带入参考图,改动其中不合适的内容并保留其余部分,再把结果继续用于视频生成。

    原始视频预览图;未保存可播放视频URL

    推荐理由:两款图像模型分别面向速度批量与精确编辑,接入 Luma Agents 后可继续生成视频。

9月9日周三
  1. @OpenAI69

    OpenAI 开始向 ChatGPT、ChatGPT Work 和 Codex 用户推送 ChatGPT Images 2.5,覆盖桌面、移动和网页端。同时 API 新增两款模型,GPT-Image-2.5 Flare 带来质量、编辑和速度改进,GPT-Image-2.5 Sunburst 面向细节创作提升精度,生成耗时更长。

    推荐理由:官方给出图像模型在 ChatGPT 全端上线及 API 两款新模型的定位差异,读者可据此判断创作与开发选型。

9月5日周六
9月4日周五