TY - RPRT TI - Video-OPD: Efficient Post-Training of Multimodal Large Language Models for Temporal Video Grounding via On-Policy Distillation AU - Jiaze Li AU - Hao Yin AU - Haoran Xu AU - Boshen Xu AU - Wenhui Tan AU - Zewen He AU - Jianzhong Ju AU - Zhenbo Luo AU - Jian Luan PY - 2026 UR - https://arxiv.org/abs/2602.02994 ID - 2602.02994 ER -