TY - RPRT TI - SimpleTIR: End-to-End Reinforcement Learning for Multi-Turn Tool-Integrated Reasoning AU - Zhenghai Xue AU - Longtao Zheng AU - Qian Liu AU - Yingru Li AU - Xiaosen Zheng AU - Zejun Ma AU - Bo An PY - 2025 UR - https://arxiv.org/abs/2509.02479 ID - 2509.02479 ER -