@misc{indiciaeab2b6aa60957, title = {HiRes-LLaVA: Restoring Fragmentation Input in High-Resolution Large Vision-Language Models}, author = {Runhui Huang and Xinpeng Ding and Chunwei Wang and Jianhua Han and Yulong Liu and Hengshuang Zhao and Hang Xu and Lu Hou and Wei Zhang and Xiaodan Liang}, year = {2026}, url = {https://arxiv.org/abs/2407.08706}, note = {Source identifier: 2407.08706} }