TY - RPRT TI - Reinforcement Learning Meets Large Language Models: A Survey of Advancements and Applications Across the LLM Lifecycle AU - Keliang Liu AU - Dingkang Yang AU - Ziyun Qian AU - Weijie Yin AU - Yuchi Wang AU - Hongsheng Li AU - Jun Liu AU - Peng Zhai AU - Yang Liu AU - Lihua Zhang PY - 2025 UR - https://arxiv.org/abs/2509.16679 ID - 2509.16679 ER -