TY - RPRT TI - What Language Model Architecture and Pretraining Objective Work Best for Zero-Shot Generalization? AU - Thomas Wang AU - Adam Roberts AU - Daniel Hesslow AU - Teven Le Scao AU - Hyung Won Chung AU - Iz Beltagy AU - Julien Launay AU - Colin Raffel PY - 2022 UR - https://arxiv.org/abs/2204.05832 ID - 2204.05832 ER -