TY - RPRT TI - When Can Model-Free Reinforcement Learning be Enough for Thinking? AU - Josiah P. Hanna AU - Nicholas E. Corrado PY - 2025 UR - https://arxiv.org/abs/2506.17124 ID - 2506.17124 ER -