TY - RPRT TI - In-Token Rationality Optimization: Towards Accurate and Concise LLM Reasoning via Self-Feedback AU - Mingye Zhu AU - Yi Liu AU - Zheren Fu AU - Quan Wang AU - Yongdong Zhang PY - 2025 UR - https://arxiv.org/abs/2511.09865 ID - 2511.09865 ER -