TY - RPRT TI - LongRLVR: Long-Context Reinforcement Learning Requires Verifiable Context Rewards AU - Guanzheng Chen AU - Michael Qizhe Shieh AU - Lidong Bing PY - 2026 UR - https://arxiv.org/abs/2603.02146 ID - 2603.02146 ER -