TY - RPRT TI - Nearly Minimax Optimal Offline Reinforcement Learning with Linear Function Approximation: Single-Agent MDP and Markov Game AU - Wei Xiong AU - Han Zhong AU - Chengshuai Shi AU - Cong Shen AU - Liwei Wang AU - Tong Zhang PY - 2023 UR - https://arxiv.org/abs/2205.15512 ID - 2205.15512 ER -