@misc{indiciaeb2dc68a88360, title = {A multimodal dynamical variational autoencoder for audiovisual speech representation learning}, author = {Samir Sadok and Simon Leglaive and Laurent Girin and Xavier Alameda-Pineda and Renaud Séguier}, year = {2024}, doi = {10.1016/j.neunet.2024.106120}, url = {https://arxiv.org/abs/2305.03582}, note = {Source identifier: 2305.03582} }