@misc{indiciae14421edaaf92, title = {Locality-aware Cross-modal Correspondence Learning for Dense Audio-Visual Events Localization}, author = {Ling Xing and Hongyu Qu and Rui Yan and Xiangbo Shu and Jinhui Tang}, year = {2025}, url = {https://arxiv.org/abs/2409.07967}, note = {Source identifier: 2409.07967} }