@misc{indiciaef5627e653feb, title = {EgoVLA: Learning Vision-Language-Action Models from Egocentric Human Videos}, author = {Ruihan Yang and Qinxi Yu and Yecheng Wu and Rui Yan and Borui Li and An-Chieh Cheng and Xueyan Zou and Yunhao Fang and Xuxin Cheng and Ri-Zhao Qiu and Hongxu Yin and Sifei Liu and Song Han and Yao Lu and Xiaolong Wang}, year = {2025}, url = {https://arxiv.org/abs/2507.12440}, note = {Source identifier: 2507.12440} }