TY - RPRT TI - Flatland-RL : Multi-Agent Reinforcement Learning on Trains AU - Sharada Mohanty AU - Erik Nygren AU - Florian Laurent AU - Manuel Schneider AU - Christian Scheller AU - Nilabha Bhattacharya AU - Jeremy Watson AU - Adrian Egli AU - Christian Eichenberger AU - Christian Baumberger AU - Gereon Vienken AU - Irene Sturm AU - Guillaume Sartoretti AU - Giacomo Spigler PY - 2020 UR - https://arxiv.org/abs/2012.05893 ID - 2012.05893 ER -