TY - RPRT TI - RL Is Neither a Panacea Nor a Mirage: Understanding Supervised vs. Reinforcement Learning Fine-Tuning for LLMs AU - Hangzhan Jin AU - Sicheng Lv AU - Sifan Wu AU - Mohammad Hamdaqa PY - 2025 UR - https://arxiv.org/abs/2508.16546 ID - 2508.16546 ER -