TY - RPRT TI - Diffusion Actor-Critic: Formulating Constrained Policy Iteration as Diffusion Noise Regression for Offline Reinforcement Learning AU - Linjiajie Fang AU - Ruoxue Liu AU - Jing Zhang AU - Wenjia Wang AU - Bing-Yi Jing PY - 2025 UR - https://arxiv.org/abs/2405.20555 ID - 2405.20555 ER -