@misc{indiciae68963cd93893, title = {SayAnything: Audio-Driven Lip Synchronization with Conditional Video Diffusion}, author = {Junxian Ma and Shiwen Wang and Jian Yang and Junyi Hu and Jian Liang and Guosheng Lin and Jingbo chen and Kai Li and Yu Meng}, year = {2025}, url = {https://arxiv.org/abs/2502.11515}, note = {Source identifier: 2502.11515} }