@misc{indiciaee6c5d0c3ebd0, title = {Revisiting Regularized Policy Optimization for Stable and Efficient Reinforcement Learning in Two-Player Games}, author = {Kazuki Ota and Takayuki Osa and Motoki Omura and Tatsuya Harada}, year = {2026}, url = {https://arxiv.org/abs/2602.10894}, note = {Source identifier: 2602.10894} }