@misc{indiciae4b8423c50146, title = {CRAFT: Compression via Recursive Adaptive Fusion of Video Tokens for Vision-Language Models}, author = {Yu Chen and Xiaohong Li and Xiaole Wang and Jianjin Zhang and Jun Sun and Yafeng Deng}, year = {2026}, url = {https://arxiv.org/abs/2608.01644}, note = {Source identifier: 2608.01644} }