@misc{indiciaec2db7fc05ead, title = {Unified Multimodal Models as Auto-Encoders}, author = {Zhiyuan Yan and Kaiqing Lin and Zongjian Li and Junyan Ye and Hui Han and Haochen Wang and Zhendong Wang and Bin Lin and Hao Li and Xinyan Xiao and Jingdong Wang and Haifeng Wang and Li Yuan}, year = {2026}, url = {https://arxiv.org/abs/2509.09666}, note = {Source identifier: 2509.09666} }