TY - RPRT TI - Learning Without Critics? Revisiting GRPO in Classical Reinforcement Learning Environments AU - Bryan L. M. de Oliveira AU - Felipe V. Frujeri AU - Marcos P. C. M. Queiroz AU - Luana G. B. Martins AU - Telma W. de L. Soares AU - Luckeciano C. Melo PY - 2025 UR - https://arxiv.org/abs/2511.03527 ID - 2511.03527 ER -