TY - RPRT TI - Interleaved Reasoning for Large Language Models via Reinforcement Learning AU - Roy Xie AU - David Qiu AU - Deepak Gopinath AU - Dong Lin AU - Yanchao Sun AU - Chong Wang AU - Saloni Potdar AU - Bhuwan Dhingra PY - 2026 UR - https://arxiv.org/abs/2505.19640 ID - 2505.19640 ER -