@misc{indiciaef59679e227f9, title = {TEMPLE: Incentivizing Temporal Understanding of Video Large Language Models via Progressive Pre-SFT Alignment}, author = {Shicheng Li and Lei Li and Kun Ouyang and Shuhuai Ren and Yuanxin Liu and Yuanxing Zhang and Fuzheng Zhang and Lingpeng Kong and Qi Liu and Xu Sun}, year = {2025}, url = {https://arxiv.org/abs/2503.16929}, note = {Source identifier: 2503.16929} }