@misc{indiciaea726b595de4e, title = {Steering Visual Generation in Unified Multimodal Models with Understanding Supervision}, author = {Zeyu Liu and Zanlin Ni and Yang Yue and Cheng Da and Huan Yang and Di Zhang and Kun Gai and Gao Huang}, year = {2026}, url = {https://arxiv.org/abs/2605.05781}, note = {Source identifier: 2605.05781} }