@misc{indiciae2333c71e69e0, title = {CARE-RFT: Confidence-Anchored Reinforcement Finetuning for Reliable Reasoning in Large Language Models}, author = {Shuozhe Li and Jincheng Cao and Bodun Hu and Aryan Mokhtari and Leqi Liu and Amy Zhang}, year = {2026}, url = {https://arxiv.org/abs/2602.00085}, note = {Source identifier: 2602.00085} }