@misc{indiciae831803f414e6, title = {MAGE: Multimodal Alignment and Generation Enhancement via Bridging Visual and Semantic Spaces}, author = {Shaojun E and Yuchen Yang and Jiaheng Wu and Yan Zhang and Tiejun Zhao and Ziyan Chen}, year = {2025}, url = {https://arxiv.org/abs/2507.21741}, note = {Source identifier: 2507.21741} }