@misc{indiciae5e59b16c878d, title = {Supervised Fine-Tuning versus Reinforcement Learning: A Study of Post-Training Methods for Large Language Models}, author = {Haitao Jiang and Wenbo Zhang and Jiarui Yao and Hengrui Cai and Sheng Wang and Rui Song}, year = {2026}, url = {https://arxiv.org/abs/2603.13985}, note = {Source identifier: 2603.13985} }