TY - RPRT TI - Semantically consistent Video-to-Audio Generation using Multimodal Language Large Model AU - Gehui Chen AU - Guan'an Wang AU - Xiaowen Huang AU - Jitao Sang PY - 2024 UR - https://arxiv.org/abs/2404.16305 ID - 2404.16305 ER -