@misc{indiciae750aa0375171, title = {Provably Safe Reinforcement Learning for Stochastic Reach-Avoid Problems with Entropy Regularization}, author = {Abhijit Mazumdar and Rafal Wisniewski and Manuela L. Bujorianu}, year = {2026}, url = {https://arxiv.org/abs/2601.08646}, note = {Source identifier: 2601.08646} }