@misc{indiciaefbac28f9cbb2, title = {Joint Learning of Visual-Audio Saliency Prediction and Sound Source Localization on Multi-face Videos}, author = {Minglang Qiao and Yufan Liu and Mai Xu and Xin Deng and Bing Li and Weiming Hu and Ali Borji}, year = {2021}, url = {https://arxiv.org/abs/2111.08567}, note = {Source identifier: 2111.08567} }