Planning in the Backbone: DiffAdapterVLA for Native Continuous Trajectory Generation with Driving VLMs
arXiv:2609.15322v2 Announce Type: replace-cross Abstract: Pretrained driving vision-language models (VLMs) integrate visual, route, language, and driving context into rich driving priors, yet their representation objectives remain separated from continuous dri
arXiv cs.AI··Updated just now·38 sightings