@misc{indiciaefe5c0b36ba83, title = {MINOTAUR: Multi-task Video Grounding From Multimodal Queries}, author = {Raghav Goyal and Effrosyni Mavroudi and Xitong Yang and Sainbayar Sukhbaatar and Leonid Sigal and Matt Feiszli and Lorenzo Torresani and Du Tran}, year = {2023}, url = {https://arxiv.org/abs/2302.08063}, note = {Source identifier: 2302.08063} }