TY - RPRT TI - Role-RL: Online Long-Context Processing with Role Reinforcement Learning for Distinct LLMs in Their Optimal Roles AU - Lewei He AU - Tianyu Shi AU - Pengran Huang AU - Bingzhi Chen AU - Qianglong Chen AU - Jiahui Pan PY - 2024 UR - https://arxiv.org/abs/2409.18014 ID - 2409.18014 ER -