阿里千问发布 Qwen3.8-Flash,千问办公标准模式 Token 消耗减少 75%
Token消耗减少75%,千问办公创造了新的“省钱模式”
阅读原文
本站未展示全文,请前往来源网站阅读。
AI 导读
阿里千问大模型团队发布多模态 MoE 模型 Qwen3.8-Flash,开放权重版本为 Qwen3.8-Flash-Next,主模型参数量 125B,每个 Token 只激活 6B 参数,并额外加入 51B N-gram Embedding。
来源:AI前线 · 微信公众号 · mp.weixin.qq.com