@misc{indiciaeaf7d92024519, title = {VideoComp: Advancing Fine-Grained Compositional and Temporal Alignment in Video-Text Models}, author = {Dahun Kim and AJ Piergiovanni and Ganesh Mallya and Anelia Angelova}, year = {2025}, url = {https://arxiv.org/abs/2504.03970}, note = {Source identifier: 2504.03970} }