TY - RPRT TI - Open Problems and Fundamental Limitations of Reinforcement Learning from Human Feedback AU - Stephen Casper AU - Xander Davies AU - Claudia Shi AU - Thomas Krendl Gilbert AU - Jérémy Scheurer AU - Javier Rando AU - Rachel Freedman AU - Tomasz Korbak AU - David Lindner AU - Pedro Freire AU - Tony Wang AU - Samuel Marks AU - Charbel-Raphaël Segerie AU - Micah Carroll AU - Andi Peng AU - Phillip Christoffersen AU - Mehul Damani AU - Stewart Slocum AU - Usman Anwar AU - Anand Siththaranjan AU - Max Nadeau AU - Eric J. Michaud AU - Jacob Pfau AU - Dmitrii Krasheninnikov AU - Xin Chen AU - Lauro Langosco AU - Peter Hase AU - Erdem Bıyık AU - Anca Dragan AU - David Krueger AU - Dorsa Sadigh AU - Dylan Hadfield-Menell PY - 2023 UR - https://arxiv.org/abs/2307.15217 ID - 2307.15217 ER -