@misc{indiciae73312a85a2df, title = {Enhancing Perception Capabilities of Multimodal LLMs with Training-Free Fusion}, author = {Zhuokun Chen and Jinwu Hu and Zeshuai Deng and Yufeng Wang and Bohan Zhuang and Mingkui Tan}, year = {2024}, url = {https://arxiv.org/abs/2412.01289}, note = {Source identifier: 2412.01289} }