TY - RPRT TI - The Synergy of LLMs & RL Unlocks Offline Learning of Generalizable Language-Conditioned Policies with Low-fidelity Data AU - Thomas Pouplin AU - Katarzyna Kobalczyk AU - Hao Sun AU - Mihaela van der Schaar PY - 2025 UR - https://arxiv.org/abs/2412.06877 ID - 2412.06877 ER -