@misc{indiciae854b85ff0d3b, title = {Compress, Then Prompt: Improving Accuracy-Efficiency Trade-off of LLM Inference with Transferable Prompt}, author = {Zhaozhuo Xu and Zirui Liu and Beidi Chen and Yuxin Tang and Jue Wang and Kaixiong Zhou and Xia Hu and Anshumali Shrivastava}, year = {2023}, url = {https://arxiv.org/abs/2305.11186}, note = {Source identifier: 2305.11186} }