@misc{indiciae73d1ef529601, title = {MILR: Improving Multimodal Image Generation via Test-Time Latent Reasoning}, author = {Yapeng Mi and Yanpeng Zhao and Hengli Li and Chenxi Li and Huimin Wu and Xiaojian Ma and Song-Chun Zhu and Ying Nian Wu and Qing Li}, year = {2026}, url = {https://arxiv.org/abs/2509.22761}, note = {Source identifier: 2509.22761} }