TY - RPRT TI - Learning To Sample From Diffusion Models Via Inverse Reinforcement Learning AU - Constant Bourdrez AU - Alexandre Vérine AU - Olivier Cappé PY - 2026 UR - https://arxiv.org/abs/2602.08689 ID - 2602.08689 ER -