@misc{indiciaef7e2cd296669, title = {Why Does Reinforcement Learning Generalize? A Feature-Level Mechanistic Study of Post-Training in Large Language Models}, author = {Dan Shi and Zhuowen Han and Simon Ostermann and Renren Jin and Josef van Genabith and Deyi Xiong}, year = {2026}, url = {https://arxiv.org/abs/2604.25011}, note = {Source identifier: 2604.25011} }