@misc{indiciae0ce616ee026c, title = {LPU: A Latency-Optimized and Highly Scalable Processor for Large Language Model Inference}, author = {Seungjae Moon and Jung-Hoon Kim and Junsoo Kim and Seongmin Hong and Junseo Cha and Minsu Kim and Sukbin Lim and Gyubin Choi and Dongjin Seo and Jongho Kim and Hunjong Lee and Hyunjun Park and Ryeowook Ko and Soongyu Choi and Jongse Park and Jinwon Lee and Joo-Young Kim}, year = {2024}, url = {https://arxiv.org/abs/2408.07326}, note = {Source identifier: 2408.07326} }