TY - RPRT TI - Double Q($σ$) and Q($σ, λ$): Unifying Reinforcement Learning Control Algorithms AU - Markus Dumke PY - 2017 UR - https://arxiv.org/abs/1711.01569 ID - 1711.01569 ER -