@misc{indiciaec6c8c82e5e37, title = {Visual Question Decomposition on Multimodal Large Language Models}, author = {Haowei Zhang and Jianzhe Liu and Zhen Han and Shuo Chen and Bailan He and Volker Tresp and Zhiqiang Xu and Jindong Gu}, year = {2024}, url = {https://arxiv.org/abs/2409.19339}, note = {Source identifier: 2409.19339} }