TY - RPRT TI - Revisiting Entropy Regularization: Adaptive Coefficient Unlocks Its Potential for LLM Reinforcement Learning AU - Xiaoyun Zhang AU - Xiaojian Yuan AU - Di Huang AU - Wang You AU - Chen Hu AU - Jingqing Ruan AU - Ai Jian AU - Kejiang Chen AU - Xing Hu PY - 2026 UR - https://arxiv.org/abs/2510.10959 ID - 2510.10959 ER -