TY - RPRT TI - CoF-T2I: Video Models as Pure Visual Reasoners for Text-to-Image Generation AU - Chengzhuo Tong AU - Mingkun Chang AU - Shenglong Zhang AU - Yuran Wang AU - Cheng Liang AU - Zhizheng Zhao AU - Ruichuan An AU - Bohan Zeng AU - Yang Shi AU - Yifan Dai AU - Ziming Zhao AU - Guanbin Li AU - Pengfei Wan AU - Yuanxing Zhang AU - Wentao Zhang PY - 2026 UR - https://arxiv.org/abs/2601.10061 ID - 2601.10061 ER -