TY - RPRT TI - Multi Pseudo Q-learning Based Deterministic Policy Gradient for Tracking Control of Autonomous Underwater Vehicles AU - Wenjie Shi AU - Shiji Song AU - Cheng Wu AU - C. L. Philip Chen PY - 2019 UR - https://arxiv.org/abs/1909.03204 ID - 1909.03204 ER -