@misc{indiciae62bf29f76d5d, title = {UMT: Unified Multi-modal Transformers for Joint Video Moment Retrieval and Highlight Detection}, author = {Ye Liu and Siyuan Li and Yang Wu and Chang Wen Chen and Ying Shan and Xiaohu Qie}, year = {2022}, url = {https://arxiv.org/abs/2203.12745}, note = {Source identifier: 2203.12745} }