TY - RPRT TI - Imitating Language via Scalable Inverse Reinforcement Learning AU - Markus Wulfmeier AU - Michael Bloesch AU - Nino Vieillard AU - Arun Ahuja AU - Jorg Bornschein AU - Sandy Huang AU - Artem Sokolov AU - Matt Barnes AU - Guillaume Desjardins AU - Alex Bewley AU - Sarah Maria Elisabeth Bechtle AU - Jost Tobias Springenberg AU - Nikola Momchev AU - Olivier Bachem AU - Matthieu Geist AU - Martin Riedmiller PY - 2024 UR - https://arxiv.org/abs/2409.01369 ID - 2409.01369 ER -