TY - RPRT TI - Entropy-regularized Diffusion Policy with Q-Ensembles for Offline Reinforcement Learning AU - Ruoqi Zhang AU - Ziwei Luo AU - Jens Sjölund AU - Thomas B. Schön AU - Per Mattsson PY - 2025 UR - https://arxiv.org/abs/2402.04080 ID - 2402.04080 ER -