TY - RPRT TI - Taming "data-hungry" reinforcement learning? Stability in continuous state-action spaces AU - Yaqi Duan AU - Martin J. Wainwright PY - 2024 UR - https://arxiv.org/abs/2401.05233 ID - 2401.05233 ER -