阿里千问开源 Qwen-Drive-1.0-4B:首个面向自动驾驶的视觉语言基础模型
阅读原文
本站未展示全文,请前往来源网站阅读。
AI 导读
阿里千问本周开源 Qwen-Drive-1.0-4B,这是基于 Qwen3.5-4B 构建的自动驾驶视觉语言模型,官方称其为首个面向自动驾驶的视觉语言基础模型。该模型在预训练阶段统一了 3D 感知与视觉问答并扩展至运动规划,完全保留预训练 VLM 原始架构,同时提供 SFT 和 RL 两个规划专家。经过强化学习后,模型仅以微小的开环位移误差为代价,换来人类偏好对齐和闭环安全性方面的全面提升。
来源:IT Home · ithome.com