@misc{indiciae78967f9d7252, title = {Enhancing Vision-Language Tracking by Effectively Converting Textual Cues into Visual Cues}, author = {X. Feng and D. Zhang and S. Hu and X. Li and M. Wu and J. Zhang and X. Chen and K. Huang}, year = {2024}, url = {https://arxiv.org/abs/2412.19648}, note = {Source identifier: 2412.19648} }