@misc{indiciae29eb54e2343b, title = {VLMimic: Vision Language Models are Visual Imitation Learner for Fine-grained Actions}, author = {Guanyan Chen and Meiling Wang and Te Cui and Yao Mu and Haoyang Lu and Tianxing Zhou and Zicai Peng and Mengxiao Hu and Haizhou Li and Yuan Li and Yi Yang and Yufeng Yue}, year = {2024}, url = {https://arxiv.org/abs/2410.20927}, note = {Source identifier: 2410.20927} }