@misc{indiciae012c4d169a3b, title = {CoA-VLA: Improving Vision-Language-Action Models via Visual-Textual Chain-of-Affordance}, author = {Jinming Li and Yichen Zhu and Zhibin Tang and Junjie Wen and Minjie Zhu and Xiaoyu Liu and Chengmeng Li and Ran Cheng and Yaxin Peng and Yan Peng and Feifei Feng}, year = {2025}, url = {https://arxiv.org/abs/2412.20451}, note = {Source identifier: 2412.20451} }