@misc{indiciae24fa1b7448d3, title = {VideoNSA: Native Sparse Attention Scales Video Understanding}, author = {Enxin Song and Wenhao Chai and Shusheng Yang and Ethan Armand and Xiaojun Shan and Haiyang Xu and Jianwen Xie and Zhuowen Tu}, year = {2026}, url = {https://arxiv.org/abs/2510.02295}, note = {Source identifier: 2510.02295} }