TY - RPRT TI - DeepAveragers: Offline Reinforcement Learning by Solving Derived Non-Parametric MDPs AU - Aayam Shrestha AU - Stefan Lee AU - Prasad Tadepalli AU - Alan Fern PY - 2025 UR - https://arxiv.org/abs/2010.08891 ID - 2010.08891 ER -