TY - RPRT TI - Optimal-PhiBE: A PDE-based Model-free framework for Continuous-time Reinforcement Learning AU - Yuhua Zhu AU - Yuming Zhang AU - Haoyu Zhang PY - 2025 UR - https://arxiv.org/abs/2506.05208 ID - 2506.05208 ER -