@misc{indiciae427634dd3fc4, title = {Continuous-time Risk-sensitive Reinforcement Learning via Quadratic Variation Penalty}, author = {Yanwei Jia}, year = {2026}, url = {https://arxiv.org/abs/2404.12598}, note = {Source identifier: 2404.12598} }