TY - RPRT TI - Sample-Efficient Reinforcement Learning Is Feasible for Linearly Realizable MDPs with Limited Revisiting AU - Gen Li AU - Yuxin Chen AU - Yuejie Chi AU - Yuantao Gu AU - Yuting Wei PY - 2021 UR - https://arxiv.org/abs/2105.08024 ID - 2105.08024 ER -