TY - RPRT TI - Enforcing KL Regularization in General Tsallis Entropy Reinforcement Learning via Advantage Learning AU - Lingwei Zhu AU - Zheng Chen AU - Eiji Uchibe AU - Takamitsu Matsubara PY - 2022 UR - https://arxiv.org/abs/2205.07885 ID - 2205.07885 ER -