TY - RPRT TI - Stochastic Linear Quadratic Optimal Control Problem: A Reinforcement Learning Method AU - Na Li AU - Xun Li AU - Jing Peng AU - Zuo Quan Xu PY - 2021 UR - https://arxiv.org/abs/2011.14516 ID - 2011.14516 ER -