TY - RPRT TI - Proximal Reinforcement Learning: A New Theory of Sequential Decision Making in Primal-Dual Spaces AU - Sridhar Mahadevan AU - Bo Liu AU - Philip Thomas AU - Will Dabney AU - Steve Giguere AU - Nicholas Jacek AU - Ian Gemp AU - Ji Liu PY - 2014 UR - https://arxiv.org/abs/1405.6757 ID - 1405.6757 ER -