TY - RPRT TI - Online World Modeling Enables Real-World Inverse Reinforcement Learning from Observation AU - Tyler Han AU - Bat Nemekhbold AU - Siyang Shen AU - Rohan Baijal AU - Richard Ebock AU - Harine Ravichandiran AU - Sanghun Jung AU - Kevin Huang AU - Byron Boots PY - 2026 UR - https://arxiv.org/abs/2602.24121 ID - 2602.24121 ER -