@misc{indiciae259814c2ba97, title = {GLaVE-Cap: Global-Local Aligned Video Captioning with Vision Expert Integration}, author = {Wan Xu and Feng Zhu and Yihan Zeng and Yuanfan Guo and Ming Liu and Hang Xu and Wangmeng Zuo}, year = {2025}, url = {https://arxiv.org/abs/2509.11360}, note = {Source identifier: 2509.11360} }