TY - RPRT TI - Sample-Efficient Reinforcement Learning with Stochastic Ensemble Value Expansion AU - Jacob Buckman AU - Danijar Hafner AU - George Tucker AU - Eugene Brevdo AU - Honglak Lee PY - 2019 UR - https://arxiv.org/abs/1807.01675 ID - 1807.01675 ER -