@misc{indiciae3c88228a1567, title = {CogCoM: A Visual Language Model with Chain-of-Manipulations Reasoning}, author = {Ji Qi and Ming Ding and Weihan Wang and Yushi Bai and Qingsong Lv and Wenyi Hong and Bin Xu and Lei Hou and Juanzi Li and Yuxiao Dong and Jie Tang}, year = {2025}, url = {https://arxiv.org/abs/2402.04236}, note = {Source identifier: 2402.04236} }