@misc{indiciae5aec7a9d10b1, title = {Latent Visual States for Efficient Multimodal Reasoning}, author = {Xiuwei Chen and Wentao Hu and Yongxin Wang and Zisheng Chen and Likui Zhang and Kun Xiang and Jianhua Han and Hui-Ling Zhen and Jingyuan Zou and Hang Xu and Xiaodan Liang}, year = {2026}, url = {https://arxiv.org/abs/2606.24233}, note = {Source identifier: 2606.24233} }