TY - RPRT TI - Cyclic Policy Distillation: Sample-Efficient Sim-to-Real Reinforcement Learning with Domain Randomization AU - Yuki Kadokawa AU - Lingwei Zhu AU - Yoshihisa Tsurumine AU - Takamitsu Matsubara PY - 2023 UR - https://arxiv.org/abs/2207.14561 ID - 2207.14561 ER -