TY - RPRT TI - Policy Representation via Diffusion Probability Model for Reinforcement Learning AU - Long Yang AU - Zhixiong Huang AU - Fenghao Lei AU - Yucun Zhong AU - Yiming Yang AU - Cong Fang AU - Shiting Wen AU - Binbin Zhou AU - Zhouchen Lin PY - 2023 UR - https://arxiv.org/abs/2305.13122 ID - 2305.13122 ER -