TY - RPRT TI - Posterior Sampling for Deep Reinforcement Learning AU - Remo Sasso AU - Michelangelo Conserva AU - Paulo Rauber PY - 2023 UR - https://arxiv.org/abs/2305.00477 ID - 2305.00477 ER -