TY - RPRT TI - LPU: A Latency-Optimized and Highly Scalable Processor for Large Language Model Inference AU - Seungjae Moon AU - Jung-Hoon Kim AU - Junsoo Kim AU - Seongmin Hong AU - Junseo Cha AU - Minsu Kim AU - Sukbin Lim AU - Gyubin Choi AU - Dongjin Seo AU - Jongho Kim AU - Hunjong Lee AU - Hyunjun Park AU - Ryeowook Ko AU - Soongyu Choi AU - Jongse Park AU - Jinwon Lee AU - Joo-Young Kim PY - 2024 UR - https://arxiv.org/abs/2408.07326 ID - 2408.07326 ER -