@misc{indiciaeca3a27838b23, title = {Adaptive Preference Scaling for Reinforcement Learning with Human Feedback}, author = {Ilgee Hong and Zichong Li and Alexander Bukharin and Yixiao Li and Haoming Jiang and Tianbao Yang and Tuo Zhao}, year = {2024}, url = {https://arxiv.org/abs/2406.02764}, note = {Source identifier: 2406.02764} }