@misc{indiciae69e179f5e71c, title = {LlamaRL: A Distributed Asynchronous Reinforcement Learning Framework for Efficient Large-scale LLM Training}, author = {Bo Wu and Sid Wang and Yunhao Tang and Jia Ding and Eryk Helenowski and Liang Tan and Tengyu Xu and Tushar Gowda and Zhengxing Chen and Chen Zhu and Xiaocheng Tang and Yundi Qian and Beibei Zhu and Rui Hou}, year = {2025}, url = {https://arxiv.org/abs/2505.24034}, note = {Source identifier: 2505.24034} }