@misc{indiciaec7c008031bda, title = {Vision Guided Generative Pre-trained Language Models for Multimodal Abstractive Summarization}, author = {Tiezheng Yu and Wenliang Dai and Zihan Liu and Pascale Fung}, year = {2021}, url = {https://arxiv.org/abs/2109.02401}, note = {Source identifier: 2109.02401} }