TY - RPRT TI - Q-value Regularized Decision ConvFormer for Offline Reinforcement Learning AU - Teng Yan AU - Zhendong Ruan AU - Yaobang Cai AU - Yu Han AU - Wenxian Li AU - Yang Zhang PY - 2024 UR - https://arxiv.org/abs/2409.08062 ID - 2409.08062 ER -