TY - RPRT TI - The Path of Self-Evolving Large Language Models: Achieving Data-Efficient Learning via Intrinsic Feedback AU - Hangfan Zhang AU - Siyuan Xu AU - Zhimeng Guo AU - Huaisheng Zhu AU - Shicheng Liu AU - Xinrun Wang AU - Qiaosheng Zhang AU - Yang Chen AU - Peng Ye AU - Lei Bai AU - Shuyue Hu PY - 2025 UR - https://arxiv.org/abs/2510.02752 ID - 2510.02752 ER -