TY - RPRT TI - Feedback Manipulation Regularization: Enabling Offline Agent Alignment for Imitation Learning AU - Benjamin Poole AU - Minwoo Lee PY - 2026 UR - https://arxiv.org/abs/2607.07859 ID - 2607.07859 ER -