TY - RPRT TI - Statistical Inference of the Value Function for Reinforcement Learning in Infinite Horizon Settings AU - C. Shi AU - S. Zhang AU - W. Lu AU - R. Song PY - 2025 UR - https://arxiv.org/abs/2001.04515 ID - 2001.04515 ER -