@misc{indiciaea5bd01fd749f, title = {VidMusician: Video-to-Music Generation with Semantic-Rhythmic Alignment via Hierarchical Visual Features}, author = {Sifei Li and Binxin Yang and Chunji Yin and Chong Sun and Yuxin Zhang and Weiming Dong and Chen Li}, year = {2024}, url = {https://arxiv.org/abs/2412.06296}, note = {Source identifier: 2412.06296} }