@misc{indiciae0e132e7e2750, title = {Thinking in Frames: How Visual Context and Test-Time Scaling Empower Video Reasoning}, author = {Chengzu Li and Zanyi Wang and Jiaang Li and Yi Xu and Han Zhou and Huanyu Zhang and Ruichuan An and Dengyang Jiang and Zhaochong An and Ivan Vulić and Serge Belongie and Anna Korhonen}, year = {2026}, url = {https://arxiv.org/abs/2601.21037}, note = {Source identifier: 2601.21037} }