Qwen-Drive-1.0 is a vision-language foundation model for autonomous driving that integrates 3D perception, visual question answering, and motion planning into one framework. It uses an external bird’s-eye-view perception head for object detection and map segmentation alongside a Planning Expert module that generates ego trajectories from shared representations. The team reports competitive results across open-loop, pseudo-closed-loop, and closed-loop evaluation settings.