TY - RPRT TI - CoT-VLA: Visual Chain-of-Thought Reasoning for Vision-Language-Action Models AU - Qingqing Zhao AU - Yao Lu AU - Moo Jin Kim AU - Zipeng Fu AU - Zhuoyang Zhang AU - Yecheng Wu AU - Zhaoshuo Li AU - Qianli Ma AU - Song Han AU - Chelsea Finn AU - Ankur Handa AU - Ming-Yu Liu AU - Donglai Xiang AU - Gordon Wetzstein AU - Tsung-Yi Lin PY - 2025 UR - https://arxiv.org/abs/2503.22020 ID - 2503.22020 ER -