TY - RPRT TI - Expanding the Capabilities of Reinforcement Learning via Text Feedback AU - Yuda Song AU - Lili Chen AU - Fahim Tajwar AU - Remi Munos AU - Deepak Pathak AU - J. Andrew Bagnell AU - Aarti Singh AU - Andrea Zanette PY - 2026 UR - https://arxiv.org/abs/2602.02482 ID - 2602.02482 ER -