@misc{indiciae33e0b88e9e0a, title = {Symmetric Q-learning: Reducing Skewness of Bellman Error in Online Reinforcement Learning}, author = {Motoki Omura and Takayuki Osa and Yusuke Mukuta and Tatsuya Harada}, year = {2024}, doi = {10.1609/aaai.v38i13.29362}, url = {https://arxiv.org/abs/2403.07704}, note = {Source identifier: 2403.07704} }