@misc{indiciaee31537bca30b, title = {Jointly Learning Visual and Auditory Speech Representations from Raw Data}, author = {Alexandros Haliassos and Pingchuan Ma and Rodrigo Mira and Stavros Petridis and Maja Pantic}, year = {2023}, url = {https://arxiv.org/abs/2212.06246}, note = {Source identifier: 2212.06246} }