@misc{indiciaea9cd99a8a12b, title = {End-to-end Multi-modal Video Temporal Grounding}, author = {Yi-Wen Chen and Yi-Hsuan Tsai and Ming-Hsuan Yang}, year = {2021}, url = {https://arxiv.org/abs/2107.05624}, note = {Source identifier: 2107.05624} }