TY - RPRT TI - TTRV: Test-Time Reinforcement Learning for Vision Language Models AU - Akshit Singh AU - Shyam Marjit AU - Wei Lin AU - Paul Gavrikov AU - Serena Yeung-Levy AU - Hilde Kuehne AU - Rogerio Feris AU - Sivan Doveh AU - James Glass AU - M. Jehanzeb Mirza PY - 2025 UR - https://arxiv.org/abs/2510.06783 ID - 2510.06783 ER -