千问发布 Qwen-Drive-1.0:面向自动驾驶的视觉语言基础模型
Qwen-Drive-1.0: An Initial Step towards a Vision-Language Foundation Model for Autonomous Driving
阅读原文
本站未展示全文,请前往来源网站阅读。
AI 导读
千问推出 Qwen-Drive-1.0,称其为首个在预训练阶段统一 3D 感知与视觉问答、并可扩展至运动规划的自动驾驶视觉语言基础模型,且完全不改动预训练 VLM 架构。该模型基于原生多模态的 Qwen3.5-4B,外挂 BEV 感知头等两个外部模块。
来源:Qwen Blog · qwen.ai