TY - RPRT TI - Learning to Reason by Analogy via Retrieval-Augmented Reinforcement Fine-Tuning AU - Zilin Xiao AU - Qi Ma AU - Chun-cheng Jason Chen AU - Xintao Chen AU - Avinash Atreya AU - Hanjie Chen AU - Vicente Ordonez PY - 2026 UR - https://arxiv.org/abs/2606.13680 ID - 2606.13680 ER -