TY - RPRT TI - Constitutional AI: Harmlessness from AI Feedback AU - Yuntao Bai AU - Saurav Kadavath AU - Sandipan Kundu AU - Amanda Askell AU - Jackson Kernion AU - Andy Jones AU - Anna Chen AU - Anna Goldie AU - Azalia Mirhoseini AU - Cameron McKinnon AU - Carol Chen AU - Catherine Olsson AU - Christopher Olah AU - Danny Hernandez AU - Dawn Drain AU - Deep Ganguli AU - Dustin Li AU - Eli Tran-Johnson AU - Ethan Perez AU - Jamie Kerr AU - Jared Mueller AU - Jeffrey Ladish AU - Joshua Landau AU - Kamal Ndousse AU - Kamile Lukosuite AU - Liane Lovitt AU - Michael Sellitto AU - Nelson Elhage AU - Nicholas Schiefer AU - Noemi Mercado AU - Nova DasSarma AU - Robert Lasenby AU - Robin Larson AU - Sam Ringer AU - Scott Johnston AU - Shauna Kravec AU - Sheer El Showk AU - Stanislav Fort AU - Tamera Lanham AU - Timothy Telleen-Lawton AU - Tom Conerly AU - Tom Henighan AU - Tristan Hume AU - Samuel R. Bowman AU - Zac Hatfield-Dodds AU - Ben Mann AU - Dario Amodei AU - Nicholas Joseph AU - Sam McCandlish AU - Tom Brown AU - Jared Kaplan PY - 2022 UR - https://arxiv.org/abs/2212.08073 ID - 2212.08073 ER -