@misc{indiciae22bc816dd32d, title = {US-VLA: An Ultrasound Vision-Language-Action Model for Embodied Abdomina}, author = {Cheng Zhang and Xingzheng Wu and Guihao Yan and Xifeng Hu and Zhi Liu and Mei Wu and Qing Cai}, year = {2026}, url = {https://arxiv.org/abs/2608.16074}, note = {Source identifier: 2608.16074} }