TY - RPRT TI - Actor-Accelerated Policy Dual Averaging for Reinforcement Learning in Continuous Action Spaces AU - Ji Gao AU - Caleb Ju AU - Guanghui Lan AU - Zhaohui Tong PY - 2026 UR - https://arxiv.org/abs/2603.10199 ID - 2603.10199 ER -