TY - RPRT TI - PeRL: Permutation-Enhanced Reinforcement Learning for Interleaved Vision-Language Reasoning AU - Yizhen Zhang AU - Yang Ding AU - Shuoshuo Zhang AU - Xinchen Zhang AU - Haoling Li AU - Zhong-zhi Li AU - Peijie Wang AU - Jie Wu AU - Lei Ji AU - Yelong Shen AU - Yujiu Yang AU - Yeyun Gong PY - 2025 UR - https://arxiv.org/abs/2506.14907 ID - 2506.14907 ER -