@misc{indiciaefc5ccaf95999, title = {Multimodal Large Language Models and Tunings: Vision, Language, Sensors, Audio, and Beyond}, author = {Soyeon Caren Han and Feiqi Cao and Josiah Poon and Roberto Navigli}, year = {2024}, url = {https://arxiv.org/abs/2410.05608}, note = {Source identifier: 2410.05608} }