@misc{indiciaebb4d6ece8cb9, title = {Teaching LLMs to Abstain via Fine-Grained Semantic Confidence Reward}, author = {Hao An and Yang Xu}, year = {2025}, url = {https://arxiv.org/abs/2510.24020}, note = {Source identifier: 2510.24020} }