TY - RPRT TI - ManipLVM-R1: Reinforcement Learning for Reasoning in Embodied Manipulation with Large Vision-Language Models AU - Zirui Song AU - Guangxian Ouyang AU - Mingzhe Li AU - Yuheng Ji AU - Chenxi Wang AU - Zixiang Xu AU - Zeyu Zhang AU - Xiaoqing Zhang AU - Qian Jiang AU - Zhenhao Chen AU - Zhongzhi Li AU - Rui Yan AU - Xiuying Chen PY - 2025 UR - https://arxiv.org/abs/2505.16517 ID - 2505.16517 ER -