TY - RPRT TI - Model-free Reinforcement Learning for Branching Markov Decision Processes AU - Ernst Moritz Hahn AU - Mateo Perez AU - Sven Schewe AU - Fabio Somenzi AU - Ashutosh Trivedi AU - Dominik Wojtczak PY - 2021 UR - https://arxiv.org/abs/2106.06777 ID - 2106.06777 ER -