TY - RPRT TI - D-COT: Disciplined Chain-of-Thought Learning for Efficient Reasoning in Small Language Models AU - Shunsuke Ubukata PY - 2026 UR - https://arxiv.org/abs/2602.21786 ID - 2602.21786 ER -