阿里云发布 Qwen3.7-Plus,一个把视觉与语言统一到同一个智能体基础模型中的多模态智能体模型。官方称其支持 GUI 与 CLI 统一操作、全模态输入的编码与生产力助理,以及感知、推理、grounding 和检索增强问答的视觉智能体能力,并可跨不同智能体框架泛化。该模型现通过阿里云 Model Studio API 提供,同时给出 Qwen Studio 与博客入口。
官方列出多模态智能体的能力清单与 API 入口,读者可据此判断它在自身工作流中的可用性。
👏👏 Introducing Qwen3.7-Plus — a multimodal agent model that unifies vision and language into one versatile agent foundation.
✅ Multimodal interactive hybrid agent: unified GUI & CLI operation across visual and text tasks
✅ Versatile coding agent & productivity assistant with full-modality input
✅ Visual Agent: perception, reasoning, grounding, and search-augmented QA
✅ Cross-harness generalization across diverse agent frameworks
One model. Sees, thinks, codes, acts.🙌🙌
Now available via API on Alibaba Cloud Model Studio. Try it — let us know what you build.😎
🔗🔗⬇️⬇️
Blog:qwen.ai/blog?id=qwen3.7-plus
Qwen Studio:chat.qwen.ai/?models=qwen3.7…
API:modelstudio.console.alibabac…
来源:@alibaba_cloud · x.com