观点网讯:近日,阿里千问开源自动驾驶视觉语言模型Qwen-Drive-1.0-4B。该模型基于Qwen3.5-4B构建,参数规模为4B,官方称其为首个面向自动驾驶的视觉语言基础模型。
官方介绍称,该模型在预训练阶段统一了3D感知与视觉问答,并扩展至运动规划,同时完全保留预训练VLM原始架构。
模型仅使用公开来源构建规划样本,统一各数据集轨迹格式,并从开环预测到闭环驾驶进行全面评估。
经过强化学习后,该模型仅以微小的开环位移误差为代价,实现了在人类偏好对齐和闭环安全性方面的全面提升。
需要说明的是,“首个面向自动驾驶的视觉语言基础模型”为官方说法,该4B规模模型的实际产业落地效果尚待观察。
免责声明:本文内容与数据由观点根据公开信息整理,不构成投资建议,使用前请核实。
来源:观点网
上一篇:黄文彬:跳出旅游指南!跟着我发现不一样的上海 黄文彬惠州 黄文彬视频完整版
下一篇:野生美食博主上线!唐家河黑熊爬上树梢炫核桃,还闯蜂场“测评”蜂蜜 野生美食博主上线!唐家河黑熊爬上树梢炫核桃,还闯蜂场“测评”蜂蜜