@misc{indiciaeaf5cd5172f89, title = {Transforming and Combining Rewards for Aligning Large Language Models}, author = {Zihao Wang and Chirag Nagpal and Jonathan Berant and Jacob Eisenstein and Alex D'Amour and Sanmi Koyejo and Victor Veitch}, year = {2024}, url = {https://arxiv.org/abs/2402.00742}, note = {Source identifier: 2402.00742} }