TY - RPRT TI - Explore, Exploit or Listen: Combining Human Feedback and Policy Model to Speed up Deep Reinforcement Learning in 3D Worlds AU - Zhiyu Lin AU - Brent Harrison AU - Aaron Keech AU - Mark O. Riedl PY - 2021 UR - https://arxiv.org/abs/1709.03969 ID - 1709.03969 ER -