TY - RPRT TI - Do VLMs Need Vision Transformers? Evaluating State Space Models as Vision Encoders AU - Shang-Jui Ray Kuo AU - Paola Cascante-Bonilla PY - 2026 UR - https://arxiv.org/abs/2603.19209 ID - 2603.19209 ER -