@misc{indiciae2688db3101db, title = {TIP and Polish: Text-Image-Prototype Guided Multi-Modal Generation via Commonality-Discrepancy Modeling and Refinement}, author = {Zhiyong Ma and Jiahao Chen and Qingyuan Chuai and Zhengping Li}, year = {2025}, url = {https://arxiv.org/abs/2511.21698}, note = {Source identifier: 2511.21698} }