TY - RPRT TI - Deep Primal-Dual Reinforcement Learning: Accelerating Actor-Critic using Bellman Duality AU - Woon Sang Cho AU - Mengdi Wang PY - 2017 UR - https://arxiv.org/abs/1712.02467 ID - 1712.02467 ER -