跳到正文
@AYi_AInotes· @AYi_AInotes · X·· 2026-09-02精选AI 评分67
AI 导读

阿里更新旗舰模型 Qwen3.8-Max-0902,在 CodeArena WebDev 榜单以 1691 分排名第一,超过 Claude Opus 5 的 1688 分和 Kimi K3 的 1674 分,较前代 Qwen3.8-Max 的 1669 分高出 22 分。

推荐理由

列出新版 Qwen 在代码榜单的排位与每百万 tokens 定价,可据此评估替换现有 Agent 底座的成本。

正文

Damn,全球代码第一的宝座易主了!!!

阿里今天更新的旗舰 Qwen3.8-Max-0902,
在权威三方榜单 CodeArena WebDev 直接轰出 1691 分,较前代暴涨 22 分,

一举反超 Claude Opus 5 (1688) 和 Kimi K3 (1674),正式登顶全球代码总榜第一!

2.4 万亿总参数加 100 万超长上下文,经过 Coding 和 Cowork 专项后训练后,企业级复杂工程、长程科研工作流和 Agent 自主编程能力直接被拉爆。

但我觉得最厉害的的还不是它拿了世界第一,
而是它极其残暴的帕累托斩杀线:

1️⃣ 全球顶流代码智商:在最吃复杂工程的前端与全栈 WebDev 评测中,把一众欧美顶流旗舰全踩在脚下。
2️⃣ 成本直接砍到脚脖子:输入每百万 tokens 只要 2 美元,输出 6 美元,缓存命中最低 0.17 美元,综合平均仅 5 美元左右。
3️⃣ 大模型性价比清洗:在性价比前沿曲线上,直接一刀斩杀所有价格高于 5 美元的其他模型。
以前做复杂 Agent 调 Opus 5 贵得肉疼,现在是拿着全球第一的代码底座,用着连海外零头都不到的白菜价。

完整 Arena 跑分战报和 API 接入指南放一楼了,
做 Coding Agent 的兄弟赶紧去换底座 👇

引用@Alibaba_Qwen@Alibaba_Qwen
🚀Qwen3.8-Max just got upgraded. Meet Qwen3.8-Max-0902! 2.4T parameters. 1M context tokens. Built for real world complexity. Further post trained on Coding & Cowork, Qwen3.8-Max-0902 now delivers stronger performance across complex enterprise tasks, scientific research, and long horizon workflows. 💰Pricing per 1M tokens: $2 input, $6 output. $0.17 explicit cache hit, $0.25 implicit cache hit. Now live via API on QwenCloud. Come try it! 🙌 API: https://t.co/dq3WgMk980
在 X 查看被引用的帖子

来源:@AYi_AInotes · x.com