@misc{indiciae5dfe36c467ac, title = {CogACT: A Foundational Vision-Language-Action Model for Synergizing Cognition and Action in Robotic Manipulation}, author = {Qixiu Li and Yaobo Liang and Zeyu Wang and Lin Luo and Xi Chen and Mozheng Liao and Fangyun Wei and Yu Deng and Sicheng Xu and Yizhong Zhang and Xiaofan Wang and Bei Liu and Jianlong Fu and Jianmin Bao and Dong Chen and Yuanchun Shi and Jiaolong Yang and Baining Guo}, year = {2024}, url = {https://arxiv.org/abs/2411.19650}, note = {Source identifier: 2411.19650} }