@misc{indiciae095c641bebdc, title = {Policy Optimization for Continuous Reinforcement Learning}, author = {Hanyang Zhao and Wenpin Tang and David D. Yao}, year = {2023}, url = {https://arxiv.org/abs/2305.18901}, note = {Source identifier: 2305.18901} }