@misc{indiciae804022b1ca59, title = {Modeling Paragraph-Level Vision-Language Semantic Alignment for Multi-Modal Summarization}, author = {Chenhao Cui and Xinnian Liang and Shuangzhi Wu and Zhoujun Li}, year = {2023}, url = {https://arxiv.org/abs/2208.11303}, note = {Source identifier: 2208.11303} }