@misc{indiciaec8aa7e60fb68, title = {FiLA-Video: Spatio-Temporal Compression for Fine-Grained Long Video Understanding}, author = {Yanan Guo and Wenhui Dong and Jun Song and Shiding Zhu and Xuan Zhang and Hanqing Yang and Yingbo Wang and Yang Du and Xianing Chen and Bo Zheng}, year = {2025}, url = {https://arxiv.org/abs/2504.20384}, note = {Source identifier: 2504.20384} }