TY - RPRT TI - Unifying Value Alignment and Assignment in Cross-Domain Offline Reinforcement Learning with Heterogeneous Datasets AU - Zhongjian Qiao AU - Jiafei Lyu AU - Chenjia Bai AU - Peisong Wang AU - Siyang Gao AU - Shuang Qiu PY - 2026 UR - https://arxiv.org/abs/2605.24862 ID - 2605.24862 ER -