@misc{indiciae2dcf83244a8d, title = {Audio-Oriented Multimodal Machine Comprehension: Task, Dataset and Model}, author = {Zhiqi Huang and Fenglin Liu and Xian Wu and Shen Ge and Helin Wang and Wei Fan and Yuexian Zou}, year = {2021}, url = {https://arxiv.org/abs/2107.01571}, note = {Source identifier: 2107.01571} }