TY - RPRT TI - Meta-Cognitive Reinforcement Learning with Self-Doubt and Recovery AU - Zhipeng Zhang AU - Xiongfei Su AU - Kai Li PY - 2026 UR - https://arxiv.org/abs/2601.20193 ID - 2601.20193 ER -