TY - RPRT TI - MulFeRL: Enhancing Reinforcement Learning with Verbal Feedback in a Multi-turn Loop AU - Xuancheng Li AU - Haitao Li AU - Yujia Zhou AU - YiqunLiu AU - Qingyao Ai PY - 2026 UR - https://arxiv.org/abs/2601.22900 ID - 2601.22900 ER -