@misc{indiciae0e50bfd7b81c, title = {Beyond LLaVA-HD: Diving into High-Resolution Large Multimodal Models}, author = {Yi-Fan Zhang and Qingsong Wen and Chaoyou Fu and Xue Wang and Zhang Zhang and Liang Wang and Rong Jin}, year = {2024}, url = {https://arxiv.org/abs/2406.08487}, note = {Source identifier: 2406.08487} }