@misc{indiciae33ffbe03940b, title = {Inverse-RLignment: Large Language Model Alignment from Demonstrations through Inverse Reinforcement Learning}, author = {Hao Sun and Mihaela van der Schaar}, year = {2025}, url = {https://arxiv.org/abs/2405.15624}, note = {Source identifier: 2405.15624} }