TY - RPRT TI - Inverse Reinforcement Learning Meets Large Language Model Post-Training: Basics, Advances, and Opportunities AU - Hao Sun AU - Mihaela van der Schaar PY - 2025 UR - https://arxiv.org/abs/2507.13158 ID - 2507.13158 ER -