@misc{indiciae63ac3263e2bc, title = {Multi-Layer Visual Feature Fusion in Multimodal LLMs: Methods, Analysis, and Best Practices}, author = {Junyan Lin and Haoran Chen and Yue Fan and Yingqi Fan and Xin Jin and Hui Su and Jinlan Fu and Xiaoyu Shen}, year = {2025}, url = {https://arxiv.org/abs/2503.06063}, note = {Source identifier: 2503.06063} }