TY - RPRT TI - Multi-Path Collaborative Reasoning via Reinforcement Learning AU - Jindi Lv AU - Yuhao Zhou AU - Zheng Zhu AU - Xiaofeng Wang AU - Guan Huang AU - Jiancheng Lv PY - 2025 UR - https://arxiv.org/abs/2512.01485 ID - 2512.01485 ER -