TY - RPRT TI - Reinforcement Inference: Leveraging Uncertainty for Self-Correcting Language Model Reasoning AU - Xinhai Sun PY - 2026 UR - https://arxiv.org/abs/2602.08520 ID - 2602.08520 ER -