TY - RPRT TI - Globally Optimal Hierarchical Reinforcement Learning for Linearly-Solvable Markov Decision Processes AU - Guillermo Infante AU - Anders Jonsson AU - Vicenç Gómez PY - 2022 DO - 10.1609/aaai.v36i6.20655 UR - https://arxiv.org/abs/2106.15380 ID - 2106.15380 ER -