TY - RPRT TI - Inverse-RLignment: Large Language Model Alignment from Demonstrations through Inverse Reinforcement Learning AU - Hao Sun AU - Mihaela van der Schaar PY - 2025 UR - https://arxiv.org/abs/2405.15624 ID - 2405.15624 ER -