TY - RPRT TI - Diffusion Policies with Value-Conditional Optimization for Offline Reinforcement Learning AU - Yunchang Ma AU - Tenglong Liu AU - Yixing Lan AU - Xin Yin AU - Changxin Zhang AU - Xinglong Zhang AU - Xin Xu PY - 2025 UR - https://arxiv.org/abs/2511.08922 ID - 2511.08922 ER -