@misc{indiciae7428fd074f51, title = {Mounting Video Metadata on Transformer-based Language Model for Open-ended Video Question Answering}, author = {Donggeon Lee and Seongho Choi and Youwon Jang and Byoung-Tak Zhang}, year = {2021}, url = {https://arxiv.org/abs/2108.05158}, note = {Source identifier: 2108.05158} }