@misc{indiciae845b9054a3ea, title = {Self-supervised learning for audio-visual speaker diarization}, author = {Yifan Ding and Yong Xu and Shi-Xiong Zhang and Yahuan Cong and Liqiang Wang}, year = {2020}, url = {https://arxiv.org/abs/2002.05314}, note = {Source identifier: 2002.05314} }