@misc{indiciaec22303317fa6, title = {FoleyGRAM: Video-to-Audio Generation with GRAM-Aligned Multimodal Encoders}, author = {Riccardo Fosco Gramaccioni and Christian Marinoni and Eleonora Grassucci and Giordano Cicchetti and Aurelio Uncini and Danilo Comminiello}, year = {2025}, url = {https://arxiv.org/abs/2510.05829}, note = {Source identifier: 2510.05829} }