@misc{indiciae6de5bb4d2d54, title = {MuLTI: Efficient Video-and-Language Understanding with Text-Guided MultiWay-Sampler and Multiple Choice Modeling}, author = {Jiaqi Xu and Bo Liu and Yunkuo Chen and Mengli Cheng and Xing Shi}, year = {2024}, url = {https://arxiv.org/abs/2303.05707}, note = {Source identifier: 2303.05707} }