TY - RPRT TI - Bellman operator convergence enhancements in reinforcement learning algorithms AU - David Krame Kadurha AU - Domini Jocema Leko Moutouo AU - Yae Ulrich Gaba PY - 2025 UR - https://arxiv.org/abs/2505.14564 ID - 2505.14564 ER -