TY - RPRT TI - Diffusion Policies creating a Trust Region for Offline Reinforcement Learning AU - Tianyu Chen AU - Zhendong Wang AU - Mingyuan Zhou PY - 2024 UR - https://arxiv.org/abs/2405.19690 ID - 2405.19690 ER -