TY - RPRT TI - Reinforcement Learning for Long-Horizon Interactive LLM Agents AU - Kevin Chen AU - Marco Cusumano-Towner AU - Brody Huval AU - Aleksei Petrenko AU - Jackson Hamburger AU - Vladlen Koltun AU - Philipp Krähenbühl PY - 2025 UR - https://arxiv.org/abs/2502.01600 ID - 2502.01600 ER -