TY - RPRT TI - Proximal Policy Optimization with Relative Pearson Divergence AU - Taisuke Kobayashi PY - 2021 DO - 10.1109/icra48506.2021.9560856 UR - https://arxiv.org/abs/2010.03290 ID - 2010.03290 ER -