@misc{indiciae8b64fd9f855b, title = {All in One: Exploring Unified Vision-Language Tracking with Multi-Modal Alignment}, author = {Chunhui Zhang and Xin Sun and Yiqian Yang and Li Liu and Qiong Liu and Xi Zhou and Yanfeng Wang}, year = {2025}, url = {https://arxiv.org/abs/2307.03373}, note = {Source identifier: 2307.03373} }