TY - RPRT TI - VideoGLaMM: A Large Multimodal Model for Pixel-Level Visual Grounding in Videos AU - Shehan Munasinghe AU - Hanan Gani AU - Wenqi Zhu AU - Jiale Cao AU - Eric Xing AU - Fahad Shahbaz Khan AU - Salman Khan PY - 2025 UR - https://arxiv.org/abs/2411.04923 ID - 2411.04923 ER -