@misc{indiciaea116335f5bbb, title = {A Gradient Analysis Framework for Rewarding Good and Penalizing Bad Examples in Language Models}, author = {Yi-Lin Tuan and William Yang Wang}, year = {2024}, url = {https://arxiv.org/abs/2408.16751}, note = {Source identifier: 2408.16751} }