@misc{indiciae375a5ebf1e01, title = {G\$\textasciicircum{}2\$TR: Generation-Guided Visual Token Reduction for Separate-Encoder Unified Multimodal Models}, author = {Junxian Li and Kai Liu and Zizhong Ding and Zhixin Wang and Zhikai Chen and Renjing Pei and Yulun Zhang}, year = {2026}, url = {https://arxiv.org/abs/2605.12309}, note = {Source identifier: 2605.12309} }