TY - RPRT TI - Near-optimal Offline Reinforcement Learning with Linear Representation: Leveraging Variance Information with Pessimism AU - Ming Yin AU - Yaqi Duan AU - Mengdi Wang AU - Yu-Xiang Wang PY - 2022 UR - https://arxiv.org/abs/2203.05804 ID - 2203.05804 ER -