TY - RPRT TI - Sample Complexity Reduction via Policy Difference Estimation in Tabular Reinforcement Learning AU - Adhyyan Narang AU - Andrew Wagenmaker AU - Lillian Ratliff AU - Kevin Jamieson PY - 2024 UR - https://arxiv.org/abs/2406.06856 ID - 2406.06856 ER -