@misc{indiciae64d82ff545ff, title = {MM-ACT: Learn from Multimodal Parallel Generation to Act}, author = {Haotian Liang and Xinyi Chen and Bin Wang and Mingkang Chen and Yitian Liu and Yuhao Zhang and Zanxin Chen and Tianshuo Yang and Yilun Chen and Jiangmiao Pang and Dong Liu and Xiaokang Yang and Yao Mu and Wenqi Shao and Ping Luo}, year = {2025}, url = {https://arxiv.org/abs/2512.00975}, note = {Source identifier: 2512.00975} }