TY - RPRT TI - Reinforcement Learning Improves Traversal of Parametric Knowledge in LLMs AU - Renfei Zhang AU - Manasa Kaniselvan AU - Rylan Schaeffer AU - Niloofar Mireshghallah PY - 2026 UR - https://arxiv.org/abs/2511.05933 ID - 2511.05933 ER -