@misc{indiciae478c88d9c73c, title = {Learning to Collocate Visual-Linguistic Neural Modules for Image Captioning}, author = {Xu Yang and Hanwang Zhang and Chongyang Gao and Jianfei Cai}, year = {2023}, url = {https://arxiv.org/abs/2210.01338}, note = {Source identifier: 2210.01338} }