@misc{indiciae5f3a406569d0, title = {Hierarchical Reinforcement Learning: Approximating Optimal Discounted TSP Using Local Policies}, author = {Tom Zahavy and Avinatan Hasidim and Haim Kaplan and Yishay Mansour}, year = {2018}, url = {https://arxiv.org/abs/1803.04674}, note = {Source identifier: 1803.04674} }