@misc{indiciae11bdd557c822, title = {A Reinforcement Learning Method for Environments with Stochastic Variables: Post-Decision Proximal Policy Optimization with Dual Critic Networks}, author = {Leonardo Kanashiro Felizardo and Edoardo Fadda and Paolo Brandimarte and Emilio Del-Moral-Hernandez and MariĆ” Cristina Vasconcelos Nascimento}, year = {2025}, doi = {10.1109/ijcnn64981.2025.11227565}, url = {https://arxiv.org/abs/2504.05150}, note = {Source identifier: 2504.05150} }