@misc{indiciaeee2bff2b9d29, title = {Reinforcement-aware Knowledge Distillation for LLM Reasoning}, author = {Zhaoyang Zhang and Shuli Jiang and Yantao Shen and Yuting Zhang and Dhananjay Ram and Shuo Yang and Zhuowen Tu and Wei Xia and Stefano Soatto}, year = {2026}, url = {https://arxiv.org/abs/2602.22495}, note = {Source identifier: 2602.22495} }