@misc{indiciae2d1d249286d7, title = {RRPO: Robust Reward Policy Optimization for LLM-based Emotional TTS}, author = {Cong Wang and Changfeng Gao and Yang Xiang and Zhihao Du and Keyu An and Han Zhao and Qian Chen and Xiangang Li and Yingming Gao and Ya Li}, year = {2026}, url = {https://arxiv.org/abs/2512.04552}, note = {Source identifier: 2512.04552} }