@misc{indiciae8e1af9386700, title = {MENTOR: Efficient Multimodal-Conditioned Tuning for Autoregressive Vision Generation Models}, author = {Haozhe Zhao and Zefan Cai and Shuzheng Si and Liang Chen and Jiuxiang Gu and Wen Xiao and Minjia Zhang and Junjie Hu}, year = {2026}, url = {https://arxiv.org/abs/2507.09574}, note = {Source identifier: 2507.09574} }