TY - RPRT TI - Hierarchical Policy for Non-prehensile Multi-object Rearrangement with Deep Reinforcement Learning and Monte Carlo Tree Search AU - Fan Bai AU - Fei Meng AU - Jianbang Liu AU - Jiankun Wang AU - Max Q. -H. Meng PY - 2021 UR - https://arxiv.org/abs/2109.08973 ID - 2109.08973 ER -