@misc{indiciaed76fe8f06f38, title = {How Reinforcement Learning After Next-Token Prediction Facilitates Learning}, author = {Nikolaos Tsilivis and Eran Malach and Karen Ullrich and Julia Kempe}, year = {2025}, url = {https://arxiv.org/abs/2510.11495}, note = {Source identifier: 2510.11495} }