TY - RPRT TI - Ranked Reward: Enabling Self-Play Reinforcement Learning for Combinatorial Optimization AU - Alexandre Laterre AU - Yunguan Fu AU - Mohamed Khalil Jabri AU - Alain-Sam Cohen AU - David Kas AU - Karl Hajjar AU - Torbjorn S. Dahl AU - Amine Kerkeni AU - Karim Beguir PY - 2018 UR - https://arxiv.org/abs/1807.01672 ID - 1807.01672 ER -