@misc{indiciaee17d6f697887, title = {Neuro-Symbolic Representations for Video Captioning: A Case for Leveraging Inductive Biases for Vision and Language}, author = {Hassan Akbari and Hamid Palangi and Jianwei Yang and Sudha Rao and Asli Celikyilmaz and Roland Fernandez and Paul Smolensky and Jianfeng Gao and Shih-Fu Chang}, year = {2020}, url = {https://arxiv.org/abs/2011.09530}, note = {Source identifier: 2011.09530} }