@misc{indiciae1419e38d7153, title = {Multichannel AV-wav2vec2: A Framework for Learning Multichannel Multi-Modal Speech Representation}, author = {Qiushi Zhu and Jie Zhang and Yu Gu and Yuchen Hu and Lirong Dai}, year = {2024}, url = {https://arxiv.org/abs/2401.03468}, note = {Source identifier: 2401.03468} }