TY - RPRT TI - Audio-Visual Representation Learning via Knowledge Distillation from Speech Foundation Models AU - Jing-Xuan Zhang AU - Genshun Wan AU - Jianqing Gao AU - Zhen-Hua Ling PY - 2025 UR - https://arxiv.org/abs/2502.05766 ID - 2502.05766 ER -