@misc{indiciae42a300ce50f5, title = {ETVA: Evaluation of Text-to-Video Alignment via Fine-grained Question Generation and Answering}, author = {Kaisi Guan and Zhengfeng Lai and Yuchong Sun and Peng Zhang and Wei Liu and Kieran Liu and Meng Cao and Ruihua Song}, year = {2025}, url = {https://arxiv.org/abs/2503.16867}, note = {Source identifier: 2503.16867} }