TY - RPRT TI - RRPO: Robust Reward Policy Optimization for LLM-based Emotional TTS AU - Cong Wang AU - Changfeng Gao AU - Yang Xiang AU - Zhihao Du AU - Keyu An AU - Han Zhao AU - Qian Chen AU - Xiangang Li AU - Yingming Gao AU - Ya Li PY - 2026 UR - https://arxiv.org/abs/2512.04552 ID - 2512.04552 ER -