TY - RPRT TI - VFM-VAE: Vision Foundation Models Can Be Good Tokenizers for Latent Diffusion Models AU - Tianci Bi AU - Xiaoyi Zhang AU - Yan Lu AU - Nanning Zheng PY - 2026 UR - https://arxiv.org/abs/2510.18457 ID - 2510.18457 ER -