TY - RPRT TI - Multi-Pass Q-Networks for Deep Reinforcement Learning with Parameterised Action Spaces AU - Craig J. Bester AU - Steven D. James AU - George D. Konidaris PY - 2019 UR - https://arxiv.org/abs/1905.04388 ID - 1905.04388 ER -