TY - RPRT TI - Averaging $n$-step Returns Reduces Variance in Reinforcement Learning AU - Brett Daley AU - Martha White AU - Marlos C. Machado PY - 2025 UR - https://arxiv.org/abs/2402.03903 ID - 2402.03903 ER -