TY - RPRT TI - RLinf-VLA: A Unified and Efficient Framework for Reinforcement Learning of Vision-Language-Action Models AU - Hongzhi Zang AU - Mingjie Wei AU - Si Xu AU - Yongji Wu AU - Zhen Guo AU - Yuanqing Wang AU - Hao Lin AU - Peihong Wang AU - Liangzhi Shi AU - Yuqing Xie AU - Zhexuan Xu AU - Zhihao Liu AU - Kang Chen AU - Wenhao Tang AU - Quanlu Zhang AU - Weinan Zhang AU - Chao Yu AU - Yu Wang PY - 2026 UR - https://arxiv.org/abs/2510.06710 ID - 2510.06710 ER -