TY - RPRT TI - Offline Policy Evaluation for Reinforcement Learning with Adaptively Collected Data AU - Sunil Madhow AU - Dan Qiao AU - Ming Yin AU - Yu-Xiang Wang PY - 2024 UR - https://arxiv.org/abs/2306.14063 ID - 2306.14063 ER -