@misc{indiciaeb2783208f30d, title = {PixelVLA: Advancing Pixel-level Understanding in Vision-Language-Action Model}, author = {Wenqi Liang and Gan Sun and Yao He and Jiahua Dong and Suyan Dai and Ivan Laptev and Salman Khan and Yang Cong}, year = {2026}, url = {https://arxiv.org/abs/2511.01571}, note = {Source identifier: 2511.01571} }