@misc{indiciae3112e3bab55b, title = {CrayonRobo: Object-Centric Prompt-Driven Vision-Language-Action Model for Robotic Manipulation}, author = {Xiaoqi Li and Lingyun Xu and Mingxu Zhang and Jiaming Liu and Yan Shen and Iaroslav Ponomarenko and Jiahui Xu and Liang Heng and Siyuan Huang and Shanghang Zhang and Hao Dong}, year = {2025}, url = {https://arxiv.org/abs/2505.02166}, note = {Source identifier: 2505.02166} }