TY - RPRT TI - Audio-visual Controlled Video Diffusion with Masked Selective State Spaces Modeling for Natural Talking Head Generation AU - Fa-Ting Hong AU - Zunnan Xu AU - Zixiang Zhou AU - Jun Zhou AU - Xiu Li AU - Qin Lin AU - Qinglin Lu AU - Dan Xu PY - 2025 UR - https://arxiv.org/abs/2504.02542 ID - 2504.02542 ER -