TY - RPRT TI - ReAD: Reinforcement-Guided Capability Distillation for Large Language Models AU - Xueqi Cheng AU - Xugui Zhou AU - Tyler Derr AU - Yushun Dong PY - 2026 UR - https://arxiv.org/abs/2605.11290 ID - 2605.11290 ER -