@misc{indiciae3042b9b65ca0, title = {LaVida Drive: Vision-Text Interaction VLM for Autonomous Driving with Token Selection, Recovery and Enhancement}, author = {Siwen Jiao and Yangyi Fang and Baoyun Peng and Wangqun Chen and Bharadwaj Veeravalli}, year = {2025}, url = {https://arxiv.org/abs/2411.12980}, note = {Source identifier: 2411.12980} }