TY - RPRT TI - LongLLaVA: Scaling Multi-modal LLMs to 1000 Images Efficiently via a Hybrid Architecture AU - Xidong Wang AU - Dingjie Song AU - Shunian Chen AU - Junyin Chen AU - Zhenyang Cai AU - Chen Zhang AU - Lichao Sun AU - Benyou Wang PY - 2025 UR - https://arxiv.org/abs/2409.02889 ID - 2409.02889 ER -