TY - RPRT TI - VLCap: Vision-Language with Contrastive Learning for Coherent Video Paragraph Captioning AU - Kashu Yamazaki AU - Sang Truong AU - Khoa Vo AU - Michael Kidd AU - Chase Rainwater AU - Khoa Luu AU - Ngan Le PY - 2022 UR - https://arxiv.org/abs/2206.12972 ID - 2206.12972 ER -