@misc{indiciae8112ce89b76a, title = {See Once, Then Act: Vision-Language-Action Model with Task Learning from One-Shot Video Demonstrations}, author = {Guangyan Chen and Meiling Wang and Qi Shao and Zichen Zhou and Weixin Mao and Te Cui and Minzhao Zhu and Yinan Deng and Luojie Yang and Zhanqi Zhang and Yi Yang and Hua Chen and Yufeng Yue}, year = {2025}, url = {https://arxiv.org/abs/2512.07582}, note = {Source identifier: 2512.07582} }