@misc{indiciaec946203bcf12, title = {A Comprehensive Survey and Guide to Multimodal Large Language Models in Vision-Language Tasks}, author = {Chia Xin Liang and Pu Tian and Caitlyn Heqi Yin and Yao Yua and Wei An-Hou and Li Ming and Xinyuan Song and Tianyang Wang and Ziqian Bi and Ming Liu}, year = {2025}, url = {https://arxiv.org/abs/2411.06284}, note = {Source identifier: 2411.06284} }