@misc{indiciaeee9b754a4c25, title = {VQ-VLA: Improving Vision-Language-Action Models via Scaling Vector-Quantized Action Tokenizers}, author = {Yating Wang and Haoyi Zhu and Mingyu Liu and Jiange Yang and Hao-Shu Fang and Tong He}, year = {2025}, url = {https://arxiv.org/abs/2507.01016}, note = {Source identifier: 2507.01016} }