TY - RPRT TI - Video Active Perception: Effective Inference-Time Long-Form Video Understanding with Vision-Language Models AU - Martin Q. Ma AU - Willis Guo AU - Aditya Agrawal AU - Ankit Gupta AU - Paul Pu Liang AU - Ruslan Salakhutdinov AU - Louis-Philippe Morency PY - 2026 UR - https://arxiv.org/abs/2605.01662 ID - 2605.01662 ER -