TY - RPRT TI - Evaluating Large Language Models Trained on Code AU - Mark Chen AU - Jerry Tworek AU - Heewoo Jun AU - Qiming Yuan AU - Henrique Ponde de Oliveira Pinto AU - Jared Kaplan AU - Harri Edwards AU - Yuri Burda AU - Nicholas Joseph AU - Greg Brockman AU - Alex Ray AU - Raul Puri AU - Gretchen Krueger AU - Michael Petrov AU - Heidy Khlaaf AU - Girish Sastry AU - Pamela Mishkin AU - Brooke Chan AU - Scott Gray AU - Nick Ryder AU - Mikhail Pavlov AU - Alethea Power AU - Lukasz Kaiser AU - Mohammad Bavarian AU - Clemens Winter AU - Philippe Tillet AU - Felipe Petroski Such AU - Dave Cummings AU - Matthias Plappert AU - Fotios Chantzis AU - Elizabeth Barnes AU - Ariel Herbert-Voss AU - William Hebgen Guss AU - Alex Nichol AU - Alex Paino AU - Nikolas Tezak AU - Jie Tang AU - Igor Babuschkin AU - Suchir Balaji AU - Shantanu Jain AU - William Saunders AU - Christopher Hesse AU - Andrew N. Carr AU - Jan Leike AU - Josh Achiam AU - Vedant Misra AU - Evan Morikawa AU - Alec Radford AU - Matthew Knight AU - Miles Brundage AU - Mira Murati AU - Katie Mayer AU - Peter Welinder AU - Bob McGrew AU - Dario Amodei AU - Sam McCandlish AU - Ilya Sutskever AU - Wojciech Zaremba PY - 2021 UR - https://arxiv.org/abs/2107.03374 ID - 2107.03374 ER -