TY - RPRT TI - Succeed or Learn Slowly: Sample Efficient Off-Policy Reinforcement Learning for Mobile App Control AU - Georgios Papoudakis AU - Thomas Coste AU - Jianye Hao AU - Jun Wang AU - Kun Shao PY - 2025 UR - https://arxiv.org/abs/2509.01720 ID - 2509.01720 ER -