@misc{indiciae11eb9536c1e5, title = {Learning to Accelerate Vision-Language-Action Models through Adaptive Visual Token Caching}, author = {Yujie Wei and Jiahan Fan and Jiyu Guo and Ruichen Zhen and Rui Shao and Xiu Su and Zeke Xie and Hongxun Yao and Shuo Yang}, year = {2026}, url = {https://arxiv.org/abs/2602.00686}, note = {Source identifier: 2602.00686} }