TY - RPRT TI - Large Language Models Reasoning Abilities Under Non-Ideal Conditions After RL-Fine-Tuning AU - Chang Tian AU - Matthew B. Blaschko AU - Mingzhe Xing AU - Xiuxing Li AU - Yinliang Yue AU - Marie-Francine Moens PY - 2025 UR - https://arxiv.org/abs/2508.04848 ID - 2508.04848 ER -