@misc{indiciae07ac18786156, title = {Audio-visual Contrastive Alignment for Diffusion-based Visual-conditioned Speech Enhancement}, author = {Colombe Mboungou and Mostafa Sadeghi and Jean-Eudes Ayilo and Romain Serizel}, year = {2026}, url = {https://arxiv.org/abs/2606.23712}, note = {Source identifier: 2606.23712} }