TY - RPRT TI - Model-Based Reinforcement Learning Exploiting State-Action Equivalence AU - Mahsa Asadi AU - Mohammad Sadegh Talebi AU - Hippolyte Bourel AU - Odalric-Ambrym Maillard PY - 2019 UR - https://arxiv.org/abs/1910.04077 ID - 1910.04077 ER -