TY - RPRT TI - When LLaVA Meets Objects: Token Composition for Vision-Language-Models AU - Soumya Jahagirdar AU - Walid Bousselham AU - Anna Kukleva AU - Hilde Kuehne PY - 2026 UR - https://arxiv.org/abs/2602.04864 ID - 2602.04864 ER -