@misc{indiciaeaf78fce4d491, title = {WeMMU: Enhanced Bridging of Vision-Language Models and Diffusion Models via Noisy Query Tokens}, author = {Jian Yang and Dacheng Yin and Xiaoxuan He and Yong Li and Fengyun Rao and Jing Lyu and Wei Zhai and Yang Cao and Zheng-Jun Zha}, year = {2025}, url = {https://arxiv.org/abs/2512.02536}, note = {Source identifier: 2512.02536} }