TY - RPRT TI - R2IF: Aligning Reasoning with Decisions via Composite Rewards for Interpretable LLM Function Calling AU - Aijia Cheng AU - Kailong Wang AU - Ling Shi AU - Yongxin Zhao PY - 2026 UR - https://arxiv.org/abs/2604.20316 ID - 2604.20316 ER -