@misc{indiciaef14732422417, title = {MoMuSE: Momentum Multi-modal Target Speaker Extraction for Real-time Scenarios with Impaired Visual Cues}, author = {Junjie Li and Ke Zhang and Shuai Wang and Kong Aik Lee and Man-Wai Mak and Haizhou Li}, year = {2025}, url = {https://arxiv.org/abs/2412.08247}, note = {Source identifier: 2412.08247} }