TY - RPRT TI - Reinforcement-aware Knowledge Distillation for LLM Reasoning AU - Zhaoyang Zhang AU - Shuli Jiang AU - Yantao Shen AU - Yuting Zhang AU - Dhananjay Ram AU - Shuo Yang AU - Zhuowen Tu AU - Wei Xia AU - Stefano Soatto PY - 2026 UR - https://arxiv.org/abs/2602.22495 ID - 2602.22495 ER -