TY - RPRT TI - Text2Grad: Reinforcement Learning from Natural Language Feedback AU - Hanyang Wang AU - Lu Wang AU - Chaoyun Zhang AU - Tianjun Mao AU - Si Qin AU - Qingwei Lin AU - Saravan Rajmohan AU - Dongmei Zhang PY - 2026 UR - https://arxiv.org/abs/2505.22338 ID - 2505.22338 ER -