TY - RPRT TI - Reinforcement Fine-Tuning of Flow-Matching Policies for Vision-Language-Action Models AU - Mingyang Lyu AU - Yinqian Sun AU - Erliang Lin AU - Huangrui Li AU - Ruolin Chen AU - Feifei Zhao AU - Yi Zeng PY - 2026 UR - https://arxiv.org/abs/2510.09976 ID - 2510.09976 ER -