TY - RPRT TI - RLAIF vs. RLHF: Scaling Reinforcement Learning from Human Feedback with AI Feedback AU - Harrison Lee AU - Samrat Phatale AU - Hassan Mansoor AU - Thomas Mesnard AU - Johan Ferret AU - Kellie Lu AU - Colton Bishop AU - Ethan Hall AU - Victor Carbune AU - Abhinav Rastogi AU - Sushant Prakash PY - 2024 UR - https://arxiv.org/abs/2309.00267 ID - 2309.00267 ER -