TY - RPRT TI - Beyond Accuracy: Dissecting Mathematical Reasoning for LLMs Under Reinforcement Learning AU - Jiayu Wang AU - Yifei Ming AU - Zixuan Ke AU - Caiming Xiong AU - Shafiq Joty AU - Aws Albarghouthi AU - Frederic Sala PY - 2025 UR - https://arxiv.org/abs/2506.04723 ID - 2506.04723 ER -