@misc{indiciae610a9ecc5040, title = {Audio-Driven Talking Face Video Generation with Joint Uncertainty Learning}, author = {Yifan Xie and Fei Ma and Yi Bin and Ying He and Fei Yu}, year = {2025}, url = {https://arxiv.org/abs/2504.18810}, note = {Source identifier: 2504.18810} }