TY - RPRT TI - LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance AU - Yuchun Fan AU - Bei Li AU - Peiguang Li AU - Yilin Wang AU - Yongyu Mu AU - Jian Yang AU - Xin Chen AU - Rongxiang Weng AU - Jingang Wang AU - Xunliang Cai AU - Jingbo Zhu AU - Tong Xiao PY - 2026 UR - https://arxiv.org/abs/2605.22567 ID - 2605.22567 ER -