TY - RPRT TI - ComputerRL: Scaling End-to-End Online Reinforcement Learning for Computer Use Agents AU - Hanyu Lai AU - Xiao Liu AU - Yanxiao Zhao AU - Han Xu AU - Hanchen Zhang AU - Bohao Jing AU - Yanyu Ren AU - Shuntian Yao AU - Yuxiao Dong AU - Jie Tang PY - 2025 UR - https://arxiv.org/abs/2508.14040 ID - 2508.14040 ER -