TY - RPRT TI - Diffusion-Augmented Markov Decision Processes for Maximum Entropy Reinforcement Learning AU - Sebastian Sanokowski AU - Kaustubh Patil AU - Majid Khadiv PY - 2026 UR - https://arxiv.org/abs/2512.02019 ID - 2512.02019 ER -