@misc{indiciae2627d6b71505, title = {Reinforcement Learning Outperforms Supervised Fine-Tuning: A Case Study on Audio Question Answering}, author = {Gang Li and Jizhong Liu and Heinrich Dinkel and Yadong Niu and Junbo Zhang and Jian Luan}, year = {2025}, url = {https://arxiv.org/abs/2503.11197}, note = {Source identifier: 2503.11197} }