TY - RPRT TI - Learning Permutations with Sinkhorn Policy Gradient AU - Patrick Emami AU - Sanjay Ranka PY - 2018 UR - https://arxiv.org/abs/1805.07010 ID - 1805.07010 ER -