@misc{indiciaed02ea2493fd1, title = {LLaVA-UHD v4: What Makes Efficient Visual Encoding in MLLMs?}, author = {Kechen Fang and Yihua Qin and Chongyi Wang and Wenshuo Ma and Tianyu Yu and Yuan Yao}, year = {2026}, url = {https://arxiv.org/abs/2605.08985}, note = {Source identifier: 2605.08985} }