TY - RPRT TI - Posterior Sampling Reinforcement Learning with Gaussian Processes for Continuous Control: Sublinear Regret Bounds for Unbounded State Spaces AU - Hamish Flynn AU - Joe Watson AU - Ingmar Posner AU - Jan Peters PY - 2026 UR - https://arxiv.org/abs/2603.08287 ID - 2603.08287 ER -