TY - RPRT TI - Self-Supervised Audio-Visual Speech Representations Learning By Multimodal Self-Distillation AU - Jing-Xuan Zhang AU - Genshun Wan AU - Zhen-Hua Ling AU - Jia Pan AU - Jianqing Gao AU - Cong Liu PY - 2022 UR - https://arxiv.org/abs/2212.02782 ID - 2212.02782 ER -