@misc{indiciaea5253a7bce97, title = {Jodi: Unification of Visual Generation and Understanding via Joint Modeling}, author = {Yifeng Xu and Zhenliang He and Meina Kan and Shiguang Shan and Xilin Chen}, year = {2025}, url = {https://arxiv.org/abs/2505.19084}, note = {Source identifier: 2505.19084} }