TY - RPRT TI - MINT: a Multi-modal Image and Narrative Text Dubbing Dataset for Foley Audio Content Planning and Generation AU - Ruibo Fu AU - Shuchen Shi AU - Hongming Guo AU - Tao Wang AU - Chunyu Qiang AU - Zhengqi Wen AU - Jianhua Tao AU - Xin Qi AU - Yi Lu AU - Xiaopeng Wang AU - Zhiyong Wang AU - Yukun Liu AU - Xuefei Liu AU - Shuai Zhang AU - Guanjun Li PY - 2024 UR - https://arxiv.org/abs/2406.10591 ID - 2406.10591 ER -