@misc{indiciae1c0faa90a647, title = {Regularizing Hidden States Enables Learning Generalizable Reward Model for LLMs}, author = {Rui Yang and Ruomeng Ding and Yong Lin and Huan Zhang and Tong Zhang}, year = {2024}, url = {https://arxiv.org/abs/2406.10216}, note = {Source identifier: 2406.10216} }