推荐理由:独立评测方自托管实测两个图像榜单排名,并对比上一代和同类开源模型,读者可了解其在开源阵营中的位置。
图像生成
全部主题AI 画图的最前线:文生图模型迭代、图像编辑能力与创作工具生态的全部动态。
最新精选
第 1–20 条 · 共 22 条
Artificial Analysis@ArtificialAnlys精选AI 评分6767
Krea@krea_ai精选AI 评分6666Krea 宣布 FLUX 3 Image 现已上线,支持在不改变其他像素的前提下进行多轮编辑、用 bounding boxes 排版图像、生成最高 4K 分辨率,并支持使用最多 10 张参考图合成。

推荐理由:原文列出了 FLUX 3 Image 在 Krea 上的具体新能力,如多轮编辑与 10 参考图合成,读者可据此判断是否替换现有图像工作流。
OpenRouter@OpenRouter精选AI 评分6666引用Black Forest Labs@bfl_aiIntroducing FLUX 3 Image. Control every pixel. Make precise multi-turn edits without changing any other pixel. Lay out the image exactly how you want using bounding boxes. Generate in up to 4K to preserve details. Use up to 10 references to compose an image. Commercial Weights available for companies running image generation at scale. Open Weights version of FLUX 3 Image is launching in the coming weeks.
推荐理由:原文给出 FLUX 3 Image 的多轮编辑、边界框布局和 4K 输出等具体能力,并说明已上线 OpenRouter。
Runway News精选AI 评分6363 Runway 发布 Runway Ads,端到端自动化投放广告创意
Runway 发布新产品 Runway Ads,连接广告账户和品牌套件后可生成视频与图像广告创意,直接发布到 Meta、Google 和 TikTok,并读取平台表现数据迭代下一轮创意。
推荐理由:Runway 官方发布并给出自身投放数据,读者可以据此评估端到端生成式投放工具对营销工作流的实际改变。
Runway News精选AI 评分6363 Runway 发布 DaVinci Resolve 插件,可在剪辑软件内直接生成和重绘素材
Runway 发布 DaVinci Resolve 插件,用户可在 Resolve Studio 内直接生成图像和视频、重绘播放头所在片段,结果自动导入 Media Pool 并上到时间线。
推荐理由:原文说明了插件在剪辑流程内生成和重绘的具体用法与付费条件,剪辑用户可据此判断是否改变现有工作流。
Qwen@Alibaba_Qwen精选AI 评分6666引用Arena.ai@arenaQwen-Image-2.1 by @Alibaba_Qwen just landed as the #1 open source model in the Image Edit Arena and Text-to-Image Arena! With 1367 pts in the Image Edit Arena, Qwen-Image-2.1 took the #1 spot among open. It landed #16 overall, just 3 pts from GPT-Image-1.5-high-fidelity at #15. See the leaderboard for the Text-to-Image arena below. Congrats to the @Alibaba_Qwen team on this contribution to the open source ecosystem!
推荐理由:官方确认 Qwen-Image-2.1 登顶两个图像 Arena 的开源榜首,榜单分数可用于同类模型的横向比较。
OpenRouter Announcements精选AI 评分8080 OpenRouter 实测20个图像生成模型的真实成本、编辑与质量差异
OpenRouter 用同一提示词实测20个图像生成模型的真实计费,1024x1024 单张图价格在 $0.006(openai/gpt-image-2)到 $0.1344(google/gemini-3-pro-image)之间,相差22倍。
推荐理由:原文用统一提示词实测20个图像模型的实际计费,给出按任务选模型的结论,比照牌价更可靠。
Hugging Face Blog精选AI 评分6262 Gradio Workflow 重建 AUTOMATIC1111 大部分功能为 Workflow1111
Hugging Face 团队用 gr.Workflow 将 AUTOMATIC1111 的主要功能重建为 Workflow1111,画布包含 11 条媒体管线。
推荐理由:原文拆解了 11 条媒体管线和 73 个节点的具体构成,展示了 Gradio Workflow 混搭多模型并自动生成 REST 与 MCP 端点的做法。
Runway News精选AI 评分6363 Runway 发布 Adobe 插件,可在 Premiere Pro 与 After Effects 内直接生成和编辑
Runway 发布 Runway Plugins,推出面向 Premiere Pro 和 After Effects 的 Adobe 插件,在时间线内直接生成图像和视频、重绘素材并放置结果,无需导出再导入。
推荐理由:官方说明插件如何消除剪辑中反复导出导入的流程,生成结果直接落入时间线并沿用现有套餐额度。
Microsoft AI News精选AI 评分6262 Microsoft 发布 MAI-Image-2.6 及 MAI-Image-2.6-Flash 图像模型
Microsoft 于 9 月 4 日发布 MAI-Image-2.6,并面向 Microsoft Foundry 开发者推出低延迟版本 MAI-Image-2.6-Flash。
推荐理由:原文来自官方发布,给出排名、速度和价格效率数据,读者可据此评估两个版本在生产场景中的取舍。
OpenRouter Announcements精选AI 评分6262 OpenRouter 上线 Visual Image Benchmarks 覆盖 39 个图像模型
OpenRouter 发布 Visual Image Benchmarks,帮助用户评估其平台上的 39 个图像模型(截至 2026 年 8 月)。挑战提示词分七类:不太可能的场景、计数、文字、空间关系、否定、编辑和一致性,结果以网格展示并支持按价格和生成时间排序。视频和音频等更多模态的评估即将推出,用户也可通过 OpenRouter API 或 Chat 试用模型。
推荐理由:原文给出七类挑战提示词和按价格与生成时间排序的结果网格,读者可直接用它对比 39 个图像模型的真实能力。
Microsoft AI News精选AI 评分6262 Microsoft AI 发布 MAI-Image-2.5-Pro 和 MAI-Voice-2-Flash 公开预览版
Microsoft AI 发布 MAI-Image-2.5-Pro 和 MAI-Voice-2-Flash,两款模型均进入公开预览。
推荐理由:原文给出两款新模型的定价、性能数字和产品落地情况,可据此比较其质量速度成本取舍。
Google DeepMind精选AI 评分7676 Google DeepMind 发布 Nano Banana 2 Lite 图像模型并向开发者开放 Gemini Omni Flash
Google DeepMind 推出图像模型 Nano Banana 2 Lite(gemini-3.1-flash-lite-image),文生图延迟 4 秒。
推荐理由:官方公告给出了两款模型的定位、价格、延迟和已知限制,开发者可直接据此选型和接入。
Microsoft AI News精选AI 评分6565 Microsoft MAI-Image-2.5 发布,登 Arena 图像编辑榜第 2
Microsoft MAI 团队发布图像模型 MAI-Image-2.5 及更快更便宜的 MAI-Image-2.5-Flash,MAI-Image-2.5 在 Arena 图像编辑榜排名第 2(超过 Nano Banana 2),文生图榜排名第 3,较 MAI-Image-2 总分提升 75 分。
推荐理由:官方公布了 Arena 图像编辑第 2 的排名、与 Flash 双版本定价和 Foundry 入口,读者可据此评估生产图像工作流的选型。
Microsoft AI News精选AI 评分7979 Microsoft Build 2026 发布 MAI 系列七款新模型,含首个推理模型 MAI-Thinking-1
Microsoft MAI 在 Build 2026 主题演讲中发布七款新模型,覆盖图像、语音、转录、推理和编码。
推荐理由:作者以当事方身份逐一公布七个新模型的定位、基准数字和开放渠道,读者可以对照竞品评估各自适用场景。
Runway News精选AI 评分6060 Runway 发布 Runway MCP 服务器,可在 Agent 中直接生成图像和视频
Runway 发布 Runway MCP(Model Context Protocol)服务器,把 Runway 接入用户已有的 Agent 和编码工具,在对话中直接生成图像和视频而无需切换上下文。
推荐理由:原文给出了接入方式和可用模型清单,读者可据此判断在自己的 Agent 工作流中调用 Runway 生成是否顺手。
Runway News精选AI 评分6262 Runway 发布 Aleph 2.0 视频编辑模型及 Edit Studio 应用
Runway 发布视频编辑模型 Aleph 2.0,并同步推出围绕其构建的 Edit Studio 应用。新模型支持编辑最长 30 秒的 1080p 视频,可做仅改动目标区域的局部编辑,用一帧编辑后的图像预览并控制最终效果,还能一次把改动应用到多个镜头。Edit Studio 面向营销团队、影视后期等场景,现已在所有 Runway 付费计划的桌面网页端开放。
推荐理由:原文给出了模型能力细节和开放范围,读者可以据此判断对现有视频素材二次加工工作流的影响。
Google Research精选AI 评分6161 Google Photos Auto frame 上线 3D 视角重构成像功能
Google 宣布在 Google Photos 的 Auto frame 功能中推出新的拍照后视角调整方法,通过 ML 模型理解场景空间布局并用生成式 AI 从新视角重构成像。
推荐理由:原文解释了两阶段 3D 场景重建加生成补全的技术路线,读者可以了解它与传统裁剪编辑的本质差别。
Microsoft AI News精选AI 评分6363 Microsoft 发布 MAI-Transcribe-1、MAI-Voice-1 和 MAI-Image-2 三款模型并上线 Foundry
Microsoft AI 宣布发布 MAI-Transcribe-1、MAI-Voice-1 和 MAI-Image-2 三款模型,现已在 Microsoft Foundry 和 MAI Playground 开放。
推荐理由:官方公布三款 MAI 模型的 Foundry 定价与基准对比,开发者可直接据此评估接入成本和可用性。
Microsoft AI News精选AI 评分6262 Microsoft MAI 发布图像生成模型 MAI-Image-2
Microsoft AI 团队发布图像生成模型 MAI-Image-2,称其使 MAI 进入 Arena.ai 榜单前三的文生图实验室行列。
推荐理由:原文给出榜单排名、可用入口和面向创意工作的三大能力重点,读者可据此判断是否试用或接入。