TY - RPRT TI - Multi-agent Hierarchical Reinforcement Learning with Dynamic Termination AU - Dongge Han AU - Wendelin Boehmer AU - Michael Wooldridge AU - Alex Rogers PY - 2019 DO - 10.1007/978-3-030-29911-8_7 UR - https://arxiv.org/abs/1910.09508 ID - 1910.09508 ER -