@misc{indiciae36ca48df2b5c, title = {Talker-T2AV: Joint Talking Audio-Video Generation with Autoregressive Diffusion Modeling}, author = {Zhen Ye and Xu Tan and Aoxiong Yin and Hongzhan Lin and Guangyan Zhang and Peiwen Sun and Yiming Li and Chi-Min Chan and Wei Ye and Shikun Zhang and Wei Xue}, year = {2026}, url = {https://arxiv.org/abs/2604.23586}, note = {Source identifier: 2604.23586} }