@misc{indiciae2ff172bf8264, title = {RewardBench: Evaluating Reward Models for Language Modeling}, author = {Nathan Lambert and Valentina Pyatkin and Jacob Morrison and LJ Miranda and Bill Yuchen Lin and Khyathi Chandu and Nouha Dziri and Sachin Kumar and Tom Zick and Yejin Choi and Noah A. Smith and Hannaneh Hajishirzi}, year = {2024}, url = {https://arxiv.org/abs/2403.13787}, note = {Source identifier: 2403.13787} }