TY - RPRT TI - Multimodal Large Language Models and Tunings: Vision, Language, Sensors, Audio, and Beyond AU - Soyeon Caren Han AU - Feiqi Cao AU - Josiah Poon AU - Roberto Navigli PY - 2024 UR - https://arxiv.org/abs/2410.05608 ID - 2410.05608 ER -