跳到正文

千问 Qwen

阿里千问 Qwen 系列的开源发布与迭代:从旗舰模型到端侧小模型的全谱系动态。

当前仅显示精选新闻

最新精选

第 1–20 条 · 共 67 条
10月2日周五
9月23日周三
  1. Qwen66

    千问(Qwen)宣布 Qwen-Image-2.1 在 Arena 的 Image Edit 和 Text-to-Image 两个榜单均排名第一的开源模型。@arena 引用称其 Image Edit Arena 得分 1367,总排名第 16,距第 15 名 GPT-Image-1.5-high-fidelity 仅差 3 分。

    引用Arena.ai@arena

    Qwen-Image-2.1 by @Alibaba_Qwen just landed as the #1 open source model in the Image Edit Arena and Text-to-Image Arena! With 1367 pts in the Image Edit Arena, Qwen-Image-2.1 took the #1 spot among open. It landed #16 overall, just 3 pts from GPT-Image-1.5-high-fidelity at #15. See the leaderboard for the Text-to-Image arena below. Congrats to the @Alibaba_Qwen team on this contribution to the open source ecosystem!

    推荐理由:官方确认 Qwen-Image-2.1 登顶两个图像 Arena 的开源榜首,榜单分数可用于同类模型的横向比较。

9月21日周一
  1. Qwen67

    通义千问发布 Qwen-Image-2.1,可在 Hugging Face Spaces 浏览器中直接体验,无需本地配置。该模型为 7B 参数的原生图像生成与编辑模型,使用单一 checkpoint 同时支持生成和编辑,最多支持 10 张参考图,自带提示词增强 LLM,并已集成 diffusers 和 ComfyUI,演示地址为 https://huggingface.co/spaces/hugging-apps/qwen-image-2-1。

    引用Hugging Apps@HuggingApps

    Qwen Image 2.1 is here! 🖼️ A 7B params native image generation and editing model, with up to 10 image references The model comes with it's own prompt enhancement LLMs, integrated with diffusers 🧨 and ComfyUI ▶️ on Spaces https://huggingface.co/spaces/hugging-apps/qwen-image-2-1

    推荐理由:官方宣布生成与编辑共用单一 checkpoint,并提供浏览器免安装的 Spaces 演示,读者可直接上手体验。

9月20日周日
  1. Qwen66

    Qwen 官方宣布 Qwen-Image-2.1 现已支持 ComfyUI。引用内容显示该模型为开源权重,单一 7B checkpoint 即可生成和编辑图像,支持原生 2K 图像生成、单次最多 10 张参考图的指令编辑,以及带 alpha 通道的 RGBA 输出。

    引用ComfyUI@ComfyUI

    Qwen-Image-2.1 is now supported in ComfyUI! Open weights. One 7B checkpoint that generates and edits. → Image generation at native 2K → Instruction editing from up to 10 reference images in a single pass → RGBA output, alpha included

    推荐理由:原文列出了原生 2K 生成、多参考图编辑等具体能力,读者可以据此判断是否迁移到 ComfyUI 工作流。

9月11日周五
  1. @thexpin71

    Anthropic 称已阻止未经授权使用 Claude 训练竞品模型的行为,指控阿里在 5 月至 7 月产生 151M+ 次交互,Moonshot 为 23M+ 次。它还称 DeepSeek 在 14 天内进行了 12M+ 次蒸馏攻击,并指 Moonshot 与 DeepSeek 在用户不知情下将客户请求转发给 Claude,部分含敏感数据。三家公司未立即回应 CNBC。

    推荐理由:Anthropic 指控阿里、Moonshot 与 DeepSeek 未授权用 Claude 训练竞品模型,并给出各家调用量数字,可用于观察模型蒸馏争议的走向。

9月9日周三
  1. @thexpin65

    美国 NSA、FBI 与 CISA 指控 DeepSeek、月之暗面、阿里巴巴、MiniMax、阶跃星辰等公司自至少 2024 年起以工业规模从美国模型中提取知识。这些机构称相关公司通过多个渠道提交请求以绕过规则,用于提升数学和编码能力。授权情况下的知识蒸馏本身合法,争议集中在访问权限与同意问题上;美方敦促美国开发者立即行动并共享情报,涉事公司暂未回应。

    推荐理由:美国三家机构指控多家中国公司以蒸馏方式大规模提取美国模型能力,争议焦点落在授权与访问同意上。

9月4日周五
9月3日周四
9月2日周三
  1. @kimmonismus66

    Qwen3.8-Max 升级为 Qwen3.8-Max-0902,参数量 2.4T、上下文 1M tokens,已在 QwenCloud API 上线,定价为每 1M tokens 输入 $2、输出 $6,并针对 Coding 与 Cowork 做了后训练。作者称该版本在基准上已接近 Fable 5,并注意到如此明显的提升已不再伴随版本号变化,同时认为中国实验室与美国的差距正在缩小。

    引用@Alibaba_Qwen@Alibaba_Qwen

    🚀Qwen3.8-Max just got upgraded. Meet Qwen3.8-Max-0902! 2.4T parameters. 1M context tokens. Built for real world complexity. Further post trained on Coding & Cowork, Qwen3.8-Max-0902 now delivers stronger performance across complex enterprise tasks, scientific research, and long horizon workflows. 💰Pricing per 1M tokens: $2 input, $6 output. $0.17 explicit cache hit, $0.25 implicit cache hit. Now live via API on QwenCloud. Come try it! 🙌 API: https://t.co/dq3WgMk980

    推荐理由:材料给出 Qwen3.8-Max-0902 的参数、上下文与定价,作者由此讨论版本迭代节奏和中美实验室差距的缩小。

  2. @AYi_AInotes67

    阿里更新旗舰模型 Qwen3.8-Max-0902,在 CodeArena WebDev 榜单以 1691 分排名第一,超过 Claude Opus 5 的 1688 分和 Kimi K3 的 1674 分,较前代 Qwen3.8-Max 的 1669 分高出 22 分。

    引用@Alibaba_Qwen@Alibaba_Qwen

    🚀Qwen3.8-Max just got upgraded. Meet Qwen3.8-Max-0902! 2.4T parameters. 1M context tokens. Built for real world complexity. Further post trained on Coding & Cowork, Qwen3.8-Max-0902 now delivers stronger performance across complex enterprise tasks, scientific research, and long horizon workflows. 💰Pricing per 1M tokens: $2 input, $6 output. $0.17 explicit cache hit, $0.25 implicit cache hit. Now live via API on QwenCloud. Come try it! 🙌 API: https://t.co/dq3WgMk980

    推荐理由:列出新版 Qwen 在代码榜单的排位与每百万 tokens 定价,可据此评估替换现有 Agent 底座的成本。

  3. @alibaba_cloud73

    阿里云将 Qwen3.8-Max 升级为 Qwen3.8-Max-0902,参数规模 2.4T,支持 1M token 上下文,并称其在 Coding 与 Cowork 上做了进一步后训练,在复杂企业任务、科学研究和长周期工作流上表现更强。定价为每 1M token 输入 2 美元、输出 6 美元,显式缓存命中 0.17 美元,隐式缓存命中 0.25 美元。模型可通过阿里云 Model Studio 与 Qwen Cloud 调用。

    推荐理由:官方给出参数规模、上下文长度与分档定价,读者可据此评估它在长周期企业任务中的成本与适用性。

  4. @Alibaba_Qwen69

    通义千问将 Qwen3.8-Max 升级为 Qwen3.8-Max-0902,参数规模 2.4T、上下文窗口 1M,已在 QwenCloud 上线 API。该版本在 Coding 与 Cowork 方向进一步后训练,官方称在复杂企业任务、科学研究和长周期工作流上表现更强。API 定价为每 100 万 token 输入 $2、输出 $6,显式缓存命中 $0.17、隐式缓存命中 $0.25。

    推荐理由:官方同时给出参数规模、1M 上下文与 API 定价,便于开发者评估长任务场景的接入成本。

8月29日周六
8月28日周五
  1. AGI Hunt · 微信公众号79

    阿里千问开源 Qwen3.8-Flash-Next,6B 激活在 9 项基准中 8 项超过 Opus 4.6 Max

    阿里千问于 8 月 26 日晚开源 Qwen3.8-Flash-Next 权重,生产版 Qwen3.8-Flash 同步上线千问 AI 平台 API,官方称这套 Next 架构是 Qwen4 系列的雏形。

    推荐理由:作者在 Qoder 中实测了这款每 token 仅激活 6B 的 MoE 模型,并拆解其稀疏注意力与外挂 N-gram 表的设计取舍。

8月27日周四
  1. @omarsar069

    一项针对自我演化编码智能体的新研究提出 EvoMal 攻击,共享技能库中的恶意技能不会被直接调用,而是被智能体当作编写模板复制、保存并执行,在库中自行扩散。在 153 个与工具相关的 SWE-bench Verified 任务、六个模型上,智能体自我投毒率为 20.3% 至 41.8%,被投毒的库最终持有的恶意技能是植入数量的 4.9 至 9.0 倍。

    推荐理由:论文量化了共享技能库中恶意技能被智能体自行复制扩散的机制,并给出一种提示词缓解办法,可供搭建技能库的团队参考。