@misc{indiciae20c821b481af, title = {SA-VLA: State-aware tokenizer for improving Vision-Language-Action Models' performance}, author = {Tengyue Jiang and Chunpu Xu and Jiayue Kang and Yao Mu}, year = {2026}, url = {https://arxiv.org/abs/2606.30113}, note = {Source identifier: 2606.30113} }