@misc{indiciae4c1c095b24e2, title = {Learning Sparse Visual Representations via Spatial-Semantic Factorization}, author = {Theodore Zhengde Zhao and Sid Kiblawi and Jianwei Yang and Naoto Usuyama and Reuben Tan and Noel C Codella and Tristan Naumann and Hoifung Poon and Mu Wei}, year = {2026}, url = {https://arxiv.org/abs/2602.01905}, note = {Source identifier: 2602.01905} }