@misc{indiciaefb4ed786129b, title = {Vision Foundation Models as Effective Visual Tokenizers for Autoregressive Image Generation}, author = {Anlin Zheng and Xin Wen and Xuanyang Zhang and Chuofan Ma and Tiancai Wang and Gang Yu and Xiangyu Zhang and Xiaojuan Qi}, year = {2025}, url = {https://arxiv.org/abs/2507.08441}, note = {Source identifier: 2507.08441} }