TY - RPRT TI - Exploiting Hybrid Policy in Reinforcement Learning for Interpretable Temporal Logic Manipulation AU - Hao Zhang AU - Hao Wang AU - Xiucai Huang AU - Wenrui Chen AU - Zhen Kan PY - 2024 DO - 10.1109/iros58592.2024.10802202 UR - https://arxiv.org/abs/2412.20338 ID - 2412.20338 ER -