TY - RPRT TI - Accelerating Reinforcement Learning Algorithms Convergence using Pre-trained Large Language Models as Tutors With Advice Reusing AU - Lukas Toral AU - Teddy Lazebnik PY - 2025 UR - https://arxiv.org/abs/2509.08329 ID - 2509.08329 ER -