@misc{indiciae9c3c2c3bda17, title = {Tri-Ergon: Fine-grained Video-to-Audio Generation with Multi-modal Conditions and LUFS Control}, author = {Bingliang Li and Fengyu Yang and Yuxin Mao and Qingwen Ye and Hongkai Chen and Yiran Zhong}, year = {2024}, url = {https://arxiv.org/abs/2412.20378}, note = {Source identifier: 2412.20378} }