TY - RPRT TI - Gradient Q$(σ, λ)$: A Unified Algorithm with Function Approximation for Reinforcement Learning AU - Long Yang AU - Yu Zhang AU - Qian Zheng AU - Pengfei Li AU - Gang Pan PY - 2019 UR - https://arxiv.org/abs/1909.02877 ID - 1909.02877 ER -