TY - RPRT TI - RLVE: Scaling Up Reinforcement Learning for Language Models with Adaptive Verifiable Environments AU - Zhiyuan Zeng AU - Hamish Ivison AU - Yiping Wang AU - Lifan Yuan AU - Shuyue Stella Li AU - Zhuorui Ye AU - Siting Li AU - Jacqueline He AU - Runlong Zhou AU - Tong Chen AU - Chenyang Zhao AU - Yulia Tsvetkov AU - Simon Shaolei Du AU - Natasha Jaques AU - Hao Peng AU - Pang Wei Koh AU - Hannaneh Hajishirzi PY - 2026 UR - https://arxiv.org/abs/2511.07317 ID - 2511.07317 ER -