@misc{indiciae7e9b408de191, title = {Efficiency Unleashed: Inference Acceleration for LLM-based Recommender Systems with Speculative Decoding}, author = {Yunjia Xi and Hangyu Wang and Bo Chen and Jianghao Lin and Menghui Zhu and Weiwen Liu and Ruiming Tang and Zhewei Wei and Weinan Zhang and Yong Yu}, year = {2025}, url = {https://arxiv.org/abs/2408.05676}, note = {Source identifier: 2408.05676} }