TY - RPRT TI - Composition-RL: Compose Your Verifiable Prompts for Reinforcement Learning of Large Language Models AU - Xin Xu AU - Clive Bai AU - Kai Yang AU - Tianhao Chen AU - Yangkun Chen AU - Weijie Liu AU - Hao Chen AU - Yang Wang AU - Saiyong Yang AU - Can Yang PY - 2026 UR - https://arxiv.org/abs/2602.12036 ID - 2602.12036 ER -