TY - RPRT TI - Entropy Regularized Reinforcement Learning Using Large Deviation Theory AU - Argenis Arriojas AU - Jacob Adamczyk AU - Stas Tiomkin AU - Rahul V. Kulkarni PY - 2023 DO - 10.1103/physrevresearch.5.023085 UR - https://arxiv.org/abs/2106.03931 ID - 2106.03931 ER -