@misc{indiciae5d01743b6d5b, title = {IntentVCNet: Bridging Spatio-Temporal Gaps for Intention-Oriented Controllable Video Captioning}, author = {Tianheng Qiu and Jingchun Gao and Jingyu Li and Huiyi Leong and Xuan Huang and Xi Wang and Xiaocheng Zhang and Kele Xu and Lan Zhang}, year = {2025}, url = {https://arxiv.org/abs/2507.18531}, note = {Source identifier: 2507.18531} }