TY - RPRT TI - Revisiting Entropy in Reinforcement Learning for Large Reasoning Models AU - Renren Jin AU - Pengzhi Gao AU - Yuqi Ren AU - Zhuowen Han AU - Tongxuan Zhang AU - Wuwei Huang AU - Wei Liu AU - Jian Luan AU - Deyi Xiong PY - 2026 UR - https://arxiv.org/abs/2511.05993 ID - 2511.05993 ER -