TY - RPRT TI - Efficient Vision-Language Models by Summarizing Visual Tokens into Compact Registers AU - Yuxin Wen AU - Qingqing Cao AU - Qichen Fu AU - Sachin Mehta AU - Mahyar Najibi PY - 2024 UR - https://arxiv.org/abs/2410.14072 ID - 2410.14072 ER -