TY - RPRT TI - Learning Grounded Vision-Language Representation for Versatile Understanding in Untrimmed Videos AU - Teng Wang AU - Jinrui Zhang AU - Feng Zheng AU - Wenhao Jiang AU - Ran Cheng AU - Ping Luo PY - 2023 UR - https://arxiv.org/abs/2303.06378 ID - 2303.06378 ER -