@misc{indiciaed5ec80c275ea, title = {TDFNet: An Efficient Audio-Visual Speech Separation Model with Top-down Fusion}, author = {Samuel Pegg and Kai Li and Xiaolin Hu}, year = {2024}, doi = {10.1109/icist59754.2023.10367130}, url = {https://arxiv.org/abs/2401.14185}, note = {Source identifier: 2401.14185} }