TY - RPRT TI - World to Code: Multi-modal Data Generation via Self-Instructed Compositional Captioning and Filtering AU - Jiacong Wang AU - Bohong Wu AU - Haiyong Jiang AU - Xun Zhou AU - Xin Xiao AU - Haoyuan Guo AU - Jun Xiao PY - 2024 UR - https://arxiv.org/abs/2409.20424 ID - 2409.20424 ER -