@misc{indiciae2d239779dbb8, title = {VISA: Agentic Self-Evolving Data Synthesis for Multimodal Instruction Following}, author = {Min Zeng and Guanxin Tan and Libin Cen and Yafei Wen and Rui Hu and Liuyang Bian and Xiaolong Chen and Xiaoxin Chen}, year = {2026}, url = {https://arxiv.org/abs/2608.26013}, note = {Source identifier: 2608.26013} }