TY - RPRT TI - VALOR: Vision-Audio-Language Omni-Perception Pretraining Model and Dataset AU - Jing Liu AU - Sihan Chen AU - Xingjian He AU - Longteng Guo AU - Xinxin Zhu AU - Weining Wang AU - Jinhui Tang PY - 2025 UR - https://arxiv.org/abs/2304.08345 ID - 2304.08345 ER -