TY - RPRT TI - Boosting Accuracy and Efficiency of Budget Forcing in LLMs via Reinforcement Learning for Mathematical Reasoning AU - Ravindra Aribowo Tarunokusumo AU - Rafael Fernandes Cunha PY - 2025 UR - https://arxiv.org/abs/2510.21398 ID - 2510.21398 ER -