TY - RPRT TI - CHESS: Optimizing LLM Inference via Channel-Wise Thresholding and Selective Sparsification AU - Junhui He AU - Shangyu Wu AU - Weidong Wen AU - Chun Jason Xue AU - Qingan Li PY - 2024 UR - https://arxiv.org/abs/2409.01366 ID - 2409.01366 ER -