@kimmonismus· @kimmonismus · X·· 2026-06-02精选AI 评分65
AI 导读
千问(Qwen)发布多模态智能体模型 Qwen3.7-Plus,将视觉与语言统一到同一智能体底座。官方列出四项能力:GUI 与 CLI 统一操作、全模态输入的编码智能体与生产力助手、具备感知推理定位与搜索增强问答的视觉智能体,以及跨智能体框架泛化,现已通过阿里云 Model Studio 开放 API(Blog:qwen.ai/blog?id=qwen3.7-plus)。转发者 @kimmonismus 认可其多模态表现,但质疑官方为何将自家模型与 GPT-5.4、Opus 4.6 对比。
推荐理由
官方把 Qwen3.7-Plus 与 GPT-5.4、Opus 4.6 并列对比,读者可据此观察多模态智能体模型的竞争位置。
正文
Qwen3.7 plus released. Looks good, but why do they compare their models to GPT-5.4 and Opus 4.6?
Anyways, multimodal as well
👏👏 Introducing Qwen3.7-Plus — a multimodal agent model that unifies vision and language into one versatile agent foundation. ✅ Multimodal interactive hybrid agent: unified GUI & CLI operation across visual and text tasks ✅ Versatile coding agent & productivity assistant with full-modality input ✅ Visual Agent: perception, reasoning, grounding, and search-augmented QA ✅ Cross-harness generalization across diverse agent frameworks One model. Sees, thinks, codes, acts.🙌🙌 Now available via API on Alibaba Cloud Model Studio. Try it — let us know what you build.😎 🔗🔗⬇️⬇️ Blog:qwen.ai/blog?id=qwen3.7-plus Qwen Studio:chat.qwen.ai/?models=qwen3.7… API:modelstudio.console.alibabac…在 X 查看被引用的帖子
来源:@kimmonismus · x.com