TY - RPRT TI - TTRSD: Test-Time Reinforcement Learning with Self-Distillation for Vision-Language Models AU - Shuning Wang AU - Zhiheng Wu AU - Xun Zhou AU - Chongyang Cui AU - Chen Jia AU - Bowen Liu AU - Chuanjie Li AU - Xiang Chen AU - Yi Yang AU - Yumeng Zhang AU - Wenjie Huang PY - 2026 UR - https://arxiv.org/abs/2609.33414 ID - 2609.33414 ER -