@misc{indiciaec7475d24d338, title = {Can Text-to-Video Generation help Video-Language Alignment?}, author = {Luca Zanella and Massimiliano Mancini and Willi Menapace and Sergey Tulyakov and Yiming Wang and Elisa Ricci}, year = {2025}, url = {https://arxiv.org/abs/2503.18507}, note = {Source identifier: 2503.18507} }