TY - RPRT TI - Enhancing Vision-Language Model Training with Reinforcement Learning in Synthetic Worlds for Real-World Success AU - George Bredis AU - Stanislav Dereka AU - Viacheslav Sinii AU - Ruslan Rakhimov AU - Daniil Gavrilov PY - 2025 UR - https://arxiv.org/abs/2508.04280 ID - 2508.04280 ER -