TY - RPRT TI - Scaling Video-Language Models to 10K Frames via Hierarchical Differential Distillation AU - Chuanqi Cheng AU - Jian Guan AU - Wei Wu AU - Rui Yan PY - 2025 UR - https://arxiv.org/abs/2504.02438 ID - 2504.02438 ER -