@misc{indiciae058effd31306, title = {Query-Kontext: An Unified Multimodal Model for Image Generation and Editing}, author = {Yuxin Song and Wenkai Dong and Shizun Wang and Qi Zhang and Song Xue and Tao Yuan and Hu Yang and Haocheng Feng and Hang Zhou and Xinyan Xiao and Jingdong Wang}, year = {2025}, url = {https://arxiv.org/abs/2509.26641}, note = {Source identifier: 2509.26641} }