TY - RPRT TI - Sample-Efficient Reinforcement Learning for Linearly-Parameterized MDPs with a Generative Model AU - Bingyan Wang AU - Yuling Yan AU - Jianqing Fan PY - 2022 UR - https://arxiv.org/abs/2105.14016 ID - 2105.14016 ER -