TY - RPRT TI - Geometric Value Iteration: Dynamic Error-Aware KL Regularization for Reinforcement Learning AU - Toshinori Kitamura AU - Lingwei Zhu AU - Takamitsu Matsubara PY - 2021 UR - https://arxiv.org/abs/2107.07659 ID - 2107.07659 ER -