TY - RPRT TI - Skill0.5: Joint Skill Internalization and Utilization for Out-of-Distribution Generalization in Agentic Reinforcement Learning AU - Jiapeng Zhu AU - Jianxiang Yu AU - Yibo Zhao AU - Chengcheng Han AU - Qi Gu AU - Xunliang Cai AU - Xiang Li AU - Weining Qian PY - 2026 UR - https://arxiv.org/abs/2605.28424 ID - 2605.28424 ER -