TY - RPRT TI - AVFSNet: Audio-Visual Speech Separation for Flexible Number of Speakers with Multi-Scale and Multi-Task Learning AU - Daning Zhang AU - Ying Wei PY - 2025 UR - https://arxiv.org/abs/2507.12972 ID - 2507.12972 ER -