TY - RPRT TI - Robust On-Policy Sampling for Data-Efficient Policy Evaluation in Reinforcement Learning AU - Rujie Zhong AU - Duohan Zhang AU - Lukas Schäfer AU - Stefano V. Albrecht AU - Josiah P. Hanna PY - 2022 UR - https://arxiv.org/abs/2111.14552 ID - 2111.14552 ER -