TY - RPRT TI - Sample-Efficient Reinforcement Learning via Counterfactual-Based Data Augmentation AU - Chaochao Lu AU - Biwei Huang AU - Ke Wang AU - José Miguel Hernández-Lobato AU - Kun Zhang AU - Bernhard Schölkopf PY - 2020 UR - https://arxiv.org/abs/2012.09092 ID - 2012.09092 ER -