@misc{indiciaed110e5c82d9e, title = {GSRM: Generative Speech Reward Model for Speech RLHF}, author = {Maohao Shen and Tejas Jayashankar and Osama Hanna and Naoyuki Kanda and Yancheng Wang and Kateřina Žmolíková and Ruiming Xie and Niko Moritz and Anfeng Xu and Yashesh Gaur and Gregory Wornell and Qing He and Jilong Wu}, year = {2026}, url = {https://arxiv.org/abs/2602.13891}, note = {Source identifier: 2602.13891} }