@misc{indiciae1d74a811f347, title = {Logarithmic regret for episodic continuous-time linear-quadratic reinforcement learning over a finite-time horizon}, author = {Matteo Basei and Xin Guo and Anran Hu and Yufei Zhang}, year = {2022}, url = {https://arxiv.org/abs/2006.15316}, note = {Source identifier: 2006.15316} }