TY - RPRT TI - GRIP: Granular Reward-Guided Parameter Interpolation for Efficient Reasoning AU - Lam So AU - Canhui Wu AU - Han Lin PY - 2026 UR - https://arxiv.org/abs/2608.25583 ID - 2608.25583 ER -