TY - RPRT TI - QeRL: Beyond Efficiency -- Quantization-enhanced Reinforcement Learning for LLMs AU - Wei Huang AU - Yi Ge AU - Shuai Yang AU - Yicheng Xiao AU - Huizi Mao AU - Yujun Lin AU - Hanrong Ye AU - Sifei Liu AU - Ka Chun Cheung AU - Hongxu Yin AU - Yao Lu AU - Xiaojuan Qi AU - Song Han AU - Yukang Chen PY - 2025 UR - https://arxiv.org/abs/2510.11696 ID - 2510.11696 ER -