TY - RPRT TI - Vision-Language-Vision Auto-Encoder: Scalable Knowledge Distillation from Diffusion Models AU - Tiezheng Zhang AU - Yitong Li AU - Yu-cheng Chou AU - Jieneng Chen AU - Alan Yuille AU - Chen Wei AU - Junfei Xiao PY - 2025 UR - https://arxiv.org/abs/2507.07104 ID - 2507.07104 ER -