TY - RPRT TI - Unified Reinforcement and Imitation Learning for Vision-Language Models AU - Byung-Kwan Lee AU - Ryo Hachiuma AU - Yong Man Ro AU - Yu-Chiang Frank Wang AU - Yueh-Hua Wu PY - 2025 UR - https://arxiv.org/abs/2510.19307 ID - 2510.19307 ER -