TY - RPRT TI - In-Context Reinforcement Learning for Tool Use in Large Language Models AU - Yaoqi Ye AU - Yiran Zhao AU - Keyu Duan AU - Zeyu Zheng AU - Kenji Kawaguchi AU - Cihang Xie AU - Michael Qizhe Shieh PY - 2026 UR - https://arxiv.org/abs/2603.08068 ID - 2603.08068 ER -