TY - RPRT TI - HetRL: Efficient Reinforcement Learning for LLMs in Heterogeneous Environments AU - Yongjun He AU - Shuai Zhang AU - Jiading Gai AU - Xiyuan Zhang AU - Boran Han AU - Bernie Wang AU - Huzefa Rangwala AU - George Karypis PY - 2026 UR - https://arxiv.org/abs/2512.12476 ID - 2512.12476 ER -