TY - RPRT TI - Rethinking Ratio-Based Trust Regions for Policy Optimization in Multi-Agent Reinforcement Learning AU - Chulabhaya Wijesundara AU - Andrea Baisero AU - Zhongheng Li AU - Gregory Castañón AU - Alan Carlin AU - Christopher Amato PY - 2026 UR - https://arxiv.org/abs/2605.09212 ID - 2605.09212 ER -