@misc{indiciae7cad5dcf13f6, title = {MambaVLT: Time-Evolving Multimodal State Space Model for Vision-Language Tracking}, author = {Xinqi Liu and Li Zhou and Zikun Zhou and Jianqiu Chen and Zhenyu He}, year = {2024}, url = {https://arxiv.org/abs/2411.15459}, note = {Source identifier: 2411.15459} }