TY - RPRT TI - ClaHF: A Human Feedback-inspired Reinforcement Learning Framework for Improving Classification Tasks AU - Tianxiang Xu AU - Xiaoyan Zhu AU - Xin Lai AU - Jiayin Wang PY - 2026 UR - https://arxiv.org/abs/2605.17458 ID - 2605.17458 ER -