TY - RPRT TI - SVR: Self-Verifying Refinement via Joint Verdict-Confidence Reinforcement Learning for Adaptive Test-Time Compute AU - Hongyu Chen AU - Liang Lin AU - Guangrun Wang PY - 2026 UR - https://arxiv.org/abs/2607.28457 ID - 2607.28457 ER -