TY - RPRT TI - A Provably Efficient Sample Collection Strategy for Reinforcement Learning AU - Jean Tarbouriech AU - Matteo Pirotta AU - Michal Valko AU - Alessandro Lazaric PY - 2021 UR - https://arxiv.org/abs/2007.06437 ID - 2007.06437 ER -