TY - RPRT TI - Audio-Enhanced Vision-Language Modeling with Latent Space Broadening for High Quality Data Expansion AU - Yu Sun AU - Yin Li AU - Ruixiao Sun AU - Chunhui Liu AU - Fangming Zhou AU - Ze Jin AU - Linjie Wang AU - Xiang Shen AU - Zhuolin Hao AU - Hongyu Xiong PY - 2025 UR - https://arxiv.org/abs/2503.17551 ID - 2503.17551 ER -