TY - RPRT TI - Fewer Tokens and Fewer Videos: Extending Video Understanding Abilities in Large Vision-Language Models AU - Shimin Chen AU - Yitian Yuan AU - Shaoxiang Chen AU - Zequn Jie AU - Lin Ma PY - 2024 UR - https://arxiv.org/abs/2406.08024 ID - 2406.08024 ER -