TY - RPRT TI - GROW: Group-Relative Advantage-Weighted On-Policy Reinforcement Learning of Autoregressive-Diffusion Text-to-Speech model AU - Guanrou Yang AU - Tian Tan AU - Qian Chen AU - Ziyang Ma AU - Yakun Song AU - Zhikang Niu AU - Qi Chen AU - Wenming Tu AU - Haitao Li AU - Shan Yang AU - Xie Chen PY - 2026 UR - https://arxiv.org/abs/2608.03215 ID - 2608.03215 ER -