@misc{indiciaefc2d2d20d7a9, title = {VidBridge-R1: Bridging QA and Captioning for RL-based Video Understanding Models with Intermediate Proxy Tasks}, author = {Xinlong Chen and Yuanxing Zhang and Yushuo Guan and Weihong Lin and Zekun Wang and Bohan Zeng and Yang Shi and Sihan Yang and Qiang Liu and Pengfei Wan and Liang Wang and Tieniu Tan}, year = {2025}, url = {https://arxiv.org/abs/2506.09079}, note = {Source identifier: 2506.09079} }