TY - RPRT TI - Generalized Munchausen Reinforcement Learning using Tsallis KL Divergence AU - Lingwei Zhu AU - Zheng Chen AU - Matthew Schlegel AU - Martha White PY - 2024 UR - https://arxiv.org/abs/2301.11476 ID - 2301.11476 ER -