@misc{indiciae5a86dc876b33, title = {TrafficVLM: A Controllable Visual Language Model for Traffic Video Captioning}, author = {Quang Minh Dinh and Minh Khoi Ho and Anh Quan Dang and Hung Phong Tran}, year = {2024}, url = {https://arxiv.org/abs/2404.09275}, note = {Source identifier: 2404.09275} }