TY - RPRT TI - Scaling Agentic Reinforcement Learning for Tool-Integrated Reasoning in VLMs AU - Meng Lu AU - Ran Xu AU - Yi Fang AU - Wenxuan Zhang AU - Yue Yu AU - Gaurav Srivastava AU - Yuchen Zhuang AU - Mohamed Elhoseiny AU - Charles Fleming AU - Carl Yang AU - Zhengzhong Tu AU - Yang Xie AU - Guanghua Xiao AU - Hanrui Wang AU - Di Jin AU - Wenqi Shi AU - Xuan Wang PY - 2025 UR - https://arxiv.org/abs/2511.19773 ID - 2511.19773 ER -