TY - RPRT TI - Stable Gradients for Stable Learning at Scale in Deep Reinforcement Learning AU - Roger Creus Castanyer AU - Johan Obando-Ceron AU - Lu Li AU - Pierre-Luc Bacon AU - Glen Berseth AU - Aaron Courville AU - Pablo Samuel Castro PY - 2026 UR - https://arxiv.org/abs/2506.15544 ID - 2506.15544 ER -