AI 导读
据阿易 AI Notes 分享,最新 Agentic Index 榜单中 Qwen3.8 27B 的得分超过了 GPT 5.6 Terra、Claude Opus 4.8、DeepSeek V4 Pro、GLM 5.2 和 Muse Spark 1.2。
正文
本地部署了Qwen3.8的兄弟,去给你的显卡敬个礼吧,
因为这个27B的开源模型,在Agent能力这个最硬核的赛道上,把所有闭源旗舰挨个干了一遍,
最新的Agentic Index榜单出来了,Qwen 3.8 27B的得分,
超过了
→GPT 5.6 Terra,
→Claude Opus 4.8,
→DeepSeek V4 Pro,
→GLM 5.2,
→Muse Spark 1.2,
而且它能在一张RTX 3090或者4090上本地跑,
Q4量化17GB显存,没有订阅费,没有速率限制,数据不出你的机器,
注意,是超过,不是接近,
而且赢的是综合Agentic Index,不是某个边角小项,测的是工具调用、编码、浏览器操作、多步骤任务,这些恰恰是大多数人每天用模型真正在干的活,
前代Qwen3.6-27B在这个榜上大概38分,一代跳了十几个点,
27B dense,没有MoE,没有万亿参数,靠的是高质量Agent轨迹后训练加混合注意力架构,把智力密度硬拉到了旗舰水平,
它在评测里生成了1.6亿tokens的思维链,中位数才4300万,小模型靠想得更久来弥补参数量,而本地推理的token成本接近电费,
这意味着你桌上那张打游戏的显卡,现在跑的Agent能力,比几个月前最贵的云端API还强,
闭源旗舰的护城河,正在被27B的开源权重和一张消费级显卡,一点一点填平。
https://t.co/4k0l0PxsFr在 X 查看被引用的帖子
来源:@AYi_AInotes · x.com