TY - RPRT TI - CARE-RFT: Confidence-Anchored Reinforcement Finetuning for Reliable Reasoning in Large Language Models AU - Shuozhe Li AU - Jincheng Cao AU - Bodun Hu AU - Aryan Mokhtari AU - Leqi Liu AU - Amy Zhang PY - 2026 UR - https://arxiv.org/abs/2602.00085 ID - 2602.00085 ER -