TY - RPRT TI - How's it going? Reinforcement learning in language models recruits a functional welfare axis AU - Andy Q Han AU - David J. Chalmers AU - Pavel Izmailov PY - 2026 UR - https://arxiv.org/abs/2605.30232 ID - 2605.30232 ER -