TY - RPRT TI - Forward and inverse reinforcement learning sharing network weights and hyperparameters AU - Eiji Uchibe AU - Kenji Doya PY - 2022 DO - 10.1016/j.neunet.2021.08.017 UR - https://arxiv.org/abs/2008.07284 ID - 2008.07284 ER -