TY - RPRT TI - HAM-TTS: Hierarchical Acoustic Modeling for Token-Based Zero-Shot Text-to-Speech with Model and Data Scaling AU - Chunhui Wang AU - Chang Zeng AU - Bowen Zhang AU - Ziyang Ma AU - Yefan Zhu AU - Zifeng Cai AU - Jian Zhao AU - Zhonglin Jiang AU - Yong Chen PY - 2024 UR - https://arxiv.org/abs/2403.05989 ID - 2403.05989 ER -