TY - RPRT TI - SSL4RL: Revisiting Self-supervised Learning as Intrinsic Reward for Visual-Language Reasoning AU - Xiaojun Guo AU - Runyu Zhou AU - Yifei Wang AU - Qi Zhang AU - Chenheng Zhang AU - Stefanie Jegelka AU - Xiaohan Wang AU - Jiajun Chai AU - Guojun Yin AU - Wei Lin AU - Yisen Wang PY - 2026 UR - https://arxiv.org/abs/2510.16416 ID - 2510.16416 ER -