TY - RPRT TI - Projection by Convolution: Optimal Sample Complexity for Reinforcement Learning in Continuous-Space MDPs AU - Davide Maran AU - Alberto Maria Metelli AU - Matteo Papini AU - Marcello Restelli PY - 2024 UR - https://arxiv.org/abs/2405.06363 ID - 2405.06363 ER -