TY - RPRT TI - VLAS: Vision-Language-Action Model With Speech Instructions For Customized Robot Manipulation AU - Wei Zhao AU - Pengxiang Ding AU - Min Zhang AU - Zhefei Gong AU - Shuanghao Bai AU - Han Zhao AU - Donglin Wang PY - 2025 UR - https://arxiv.org/abs/2502.13508 ID - 2502.13508 ER -