@misc{indiciae8f9d3a5bedee, title = {Reward-Punishment Reinforcement Learning with Maximum Entropy}, author = {Jiexin Wang and Eiji Uchibe}, year = {2024}, doi = {10.1109/ijcnn60899.2024.10650872}, url = {https://arxiv.org/abs/2405.11784}, note = {Source identifier: 2405.11784} }