@misc{indiciae9a963adb2b20, title = {Diff-V2M: A Hierarchical Conditional Diffusion Model with Explicit Rhythmic Modeling for Video-to-Music Generation}, author = {Shulei Ji and Zihao Wang and Jiaxing Yu and Xiangyuan Yang and Shuyu Li and Songruoyao Wu and Kejun Zhang}, year = {2025}, url = {https://arxiv.org/abs/2511.09090}, note = {Source identifier: 2511.09090} }