TY - RPRT TI - VLMT: Vision-Language Multimodal Transformer for Multimodal Multi-hop Question Answering AU - Qi Zhi Lim AU - Chin Poo Lee AU - Kian Ming Lim AU - Kalaiarasi Sonai Muthu Anbananthen PY - 2025 UR - https://arxiv.org/abs/2504.08269 ID - 2504.08269 ER -