@misc{indiciaeef8f6e970210, title = {Text2Grad: Reinforcement Learning from Natural Language Feedback}, author = {Hanyang Wang and Lu Wang and Chaoyun Zhang and Tianjun Mao and Si Qin and Qingwei Lin and Saravan Rajmohan and Dongmei Zhang}, year = {2026}, url = {https://arxiv.org/abs/2505.22338}, note = {Source identifier: 2505.22338} }