TY - RPRT TI - An Optimal Discriminator Weighted Imitation Perspective for Reinforcement Learning AU - Haoran Xu AU - Shuozhe Li AU - Harshit Sikchi AU - Scott Niekum AU - Amy Zhang PY - 2025 UR - https://arxiv.org/abs/2504.13368 ID - 2504.13368 ER -