@misc{indiciaec3379355c0fd, title = {Scaling Text-Rich Image Understanding via Code-Guided Synthetic Multimodal Data Generation}, author = {Yue Yang and Ajay Patel and Matt Deitke and Tanmay Gupta and Luca Weihs and Andrew Head and Mark Yatskar and Chris Callison-Burch and Ranjay Krishna and Aniruddha Kembhavi and Christopher Clark}, year = {2025}, url = {https://arxiv.org/abs/2502.14846}, note = {Source identifier: 2502.14846} }