TY - RPRT TI - When Does Multi-Agent RL Improve LLM Workflows? Workflow, Scale, and Policy-Sharing Tradeoffs AU - Yifan Zeng AU - Yiran Wu AU - Yaolun Zhang AU - Wentian Zhao AU - Kun Wan AU - Qingyun Wu AU - Huazheng Wang PY - 2026 UR - https://arxiv.org/abs/2605.24202 ID - 2605.24202 ER -