TY - RPRT TI - Hierarchical Reinforcement Learning: Approximating Optimal Discounted TSP Using Local Policies AU - Tom Zahavy AU - Avinatan Hasidim AU - Haim Kaplan AU - Yishay Mansour PY - 2018 UR - https://arxiv.org/abs/1803.04674 ID - 1803.04674 ER -