TY - RPRT TI - $R^3$: Training Robots to Reason in Natural Language via Reinforcement Learning AU - Lehong Wu AU - Yuxiao Qu AU - Zheyuan Hu AU - Ivan Zhang AU - Limin Wei AU - Zackory Erickson AU - Aviral Kumar PY - 2026 UR - https://arxiv.org/abs/2608.26053 ID - 2608.26053 ER -