@misc{indiciae3e482c91de8c, title = {Text-Guided Video Masked Autoencoder}, author = {David Fan and Jue Wang and Shuai Liao and Zhikang Zhang and Vimal Bhat and Xinyu Li}, year = {2024}, url = {https://arxiv.org/abs/2408.00759}, note = {Source identifier: 2408.00759} }