TY - RPRT TI - REFINE-DP: Diffusion Policy Fine-tuning for Humanoid Loco-manipulation via Reinforcement Learning AU - Zhaoyuan Gu AU - Yipu Chen AU - Zimeng Chai AU - Alfred Cueva AU - Thong Nguyen AU - Yifan Wu AU - Huishu Xue AU - Minji Kim AU - Isaac Legene AU - Fukang Liu AU - KyoungMok Kim AU - Ayan Barula AU - Yongxin Chen AU - Ye Zhao PY - 2026 UR - https://arxiv.org/abs/2603.13707 ID - 2603.13707 ER -