TY - RPRT TI - From Reasoning to Agentic: Credit Assignment in Reinforcement Learning for Large Language Models AU - Chenchen Zhang PY - 2026 UR - https://arxiv.org/abs/2604.09459 ID - 2604.09459 ER -