TY - RPRT TI - Tool-R1: Sample-Efficient Reinforcement Learning for Agentic Tool Use AU - Yabo Zhang AU - Yihan Zeng AU - Qingyun Li AU - Zhen Hu AU - Kavin Han AU - Wangmeng Zuo PY - 2025 UR - https://arxiv.org/abs/2509.12867 ID - 2509.12867 ER -