TY - RPRT TI - Learning to Mix n-Step Returns: Generalizing lambda-Returns for Deep Reinforcement Learning AU - Sahil Sharma AU - Girish Raguvir J AU - Srivatsan Ramesh AU - Balaraman Ravindran PY - 2017 UR - https://arxiv.org/abs/1705.07445 ID - 1705.07445 ER -