TY - RPRT TI - STOA-VLP: Spatial-Temporal Modeling of Object and Action for Video-Language Pre-training AU - Weihong Zhong AU - Mao Zheng AU - Duyu Tang AU - Xuan Luo AU - Heng Gong AU - Xiaocheng Feng AU - Bing Qin PY - 2023 DO - 10.1609/aaai.v37i3.25483 UR - https://arxiv.org/abs/2302.09736 ID - 2302.09736 ER -