@misc{indiciae86f3e8e35c87, title = {Compression of Generative Pre-trained Language Models via Quantization}, author = {Chaofan Tao and Lu Hou and Wei Zhang and Lifeng Shang and Xin Jiang and Qun Liu and Ping Luo and Ngai Wong}, year = {2022}, url = {https://arxiv.org/abs/2203.10705}, note = {Source identifier: 2203.10705} }