@misc{indiciae7c11b5659ef0, title = {HOLA: Enhancing Audio-visual Deepfake Detection via Hierarchical Contextual Aggregations and Efficient Pre-training}, author = {Xuecheng Wu and Danlei Huang and Heli Sun and Xinyi Yin and Yifan Wang and Hao Wang and Jia Zhang and Fei Wang and Peihao Guo and Suyu Xing and Junxiao Xue and Liang He}, year = {2025}, url = {https://arxiv.org/abs/2507.22781}, note = {Source identifier: 2507.22781} }