TY - RPRT TI - VLA-RFT: Vision-Language-Action Reinforcement Fine-tuning with Verified Rewards in World Simulators AU - Hengtao Li AU - Pengxiang Ding AU - Runze Suo AU - Yihao Wang AU - Zirui Ge AU - Dongyuan Zang AU - Kexian Yu AU - Mingyang Sun AU - Hongyin Zhang AU - Donglin Wang AU - Weihua Su PY - 2025 UR - https://arxiv.org/abs/2510.00406 ID - 2510.00406 ER -