通义千问团队与华中科技大学已开源自动驾驶模型Qwen-Drive-1.0。该模型基于Qwen3.5-4B视觉语言模型,将驾驶场景理解、3D感知和车辆运动规划整合到同一框架中。

项目提供两种规划模块:一种通过模仿真实驾驶数据训练,另一种经过强化学习优化。模型不仅可以识别道路环境、回答视觉问题,还能根据连续画面生成车辆行驶轨迹。

此次开源内容包括代码、模型权重和演示数据,采用Apache 2.0许可证。官方仓库还提供了夜间路口、左转、右转和避让路边车辆等场景的演示文件。