TY - RPRT TI - Infra-Bayesian Reinforcement Learning Agents Outperform Classical RL For Worst-Case Robustness AU - Manish Aryal AU - Faiyaz Azam AU - Agnivo Banerjee AU - Syed Mahir Ahamed AU - Sai Sidhanth Manoharan Jayanthi AU - Allegra Laro AU - Clément Legentilhomme AU - Andrew Lin AU - Florian Lorkowski AU - Marina Pérez del Valle AU - Radman Rakhshandehroo AU - Patric Rommel AU - Emanuel Ruzak AU - Nathan Theng AU - Paul Yushin Rapoport PY - 2026 UR - https://arxiv.org/abs/2605.23146 ID - 2605.23146 ER -