TY - RPRT TI - Why Does Reinforcement Learning Generalize? A Feature-Level Mechanistic Study of Post-Training in Large Language Models AU - Dan Shi AU - Zhuowen Han AU - Simon Ostermann AU - Renren Jin AU - Josef van Genabith AU - Deyi Xiong PY - 2026 UR - https://arxiv.org/abs/2604.25011 ID - 2604.25011 ER -