TY - RPRT TI - Optimal Data Acquisition for Reinforcement Learning: A Large Deviations Perspective AU - Mingjie Hu AU - Jian-Qiang Hu AU - Enlu Zhou PY - 2026 UR - https://arxiv.org/abs/2605.28675 ID - 2605.28675 ER -