@misc{indiciaef7775bdd3505, title = {Speculate Deep and Accurate: Lossless and Training-Free Acceleration for Offloaded LLMs via Substitute Speculative Decoding}, author = {Pei-Shuo Wang and Jian-Jia Chen and Chun-Che Yang and Chi-Chih Chang and Ning-Chi Huang and Mohamed S. Abdelfattah and Kai-Chiang Wu}, year = {2025}, url = {https://arxiv.org/abs/2509.18344}, note = {Source identifier: 2509.18344} }