TY - RPRT TI - On the Entropy Dynamics in Reinforcement Fine-Tuning of Large Language Models AU - Shumin Wang AU - Yuexiang Xie AU - Wenhao Zhang AU - Yuchang Sun AU - Yanxi Chen AU - Yaliang Li AU - Yanyong Zhang PY - 2026 UR - https://arxiv.org/abs/2602.03392 ID - 2602.03392 ER -