@misc{indiciae3267510fb44b, title = {Preferred-Action-Optimized Diffusion Policies for Offline Reinforcement Learning}, author = {Tianle Zhang and Jiayi Guan and Lin Zhao and Yihang Li and Dongjiang Li and Zecui Zeng and Lei Sun and Yue Chen and Xuelong Wei and Lusong Li and Xiaodong He}, year = {2024}, url = {https://arxiv.org/abs/2405.18729}, note = {Source identifier: 2405.18729} }