TY - RPRT TI - Self-Improving Vision-Language-Action Models with Data Generation via Residual RL AU - Wenli Xiao AU - Haotian Lin AU - Andy Peng AU - Haoru Xue AU - Tairan He AU - Yuqi Xie AU - Fengyuan Hu AU - Jimmy Wu AU - Zhengyi Luo AU - Linxi "Jim" Fan AU - Guanya Shi AU - Yuke Zhu PY - 2025 UR - https://arxiv.org/abs/2511.00091 ID - 2511.00091 ER -