@misc{indiciae1f8b5c2b372a, title = {Audio-Enhanced Text-to-Video Retrieval using Text-Conditioned Feature Alignment}, author = {Sarah Ibrahimi and Xiaohang Sun and Pichao Wang and Amanmeet Garg and Ashutosh Sanan and Mohamed Omar}, year = {2023}, url = {https://arxiv.org/abs/2307.12964}, note = {Source identifier: 2307.12964} }