TY - RPRT TI - CARD: A Cache-Assisted Parallel Speculative Decoding Framework via Query-and-Correct Paradigm for Accelerating LLM Inference AU - Enyu Zhou AU - Kai Sheng AU - Hao Chen AU - Xin He PY - 2025 UR - https://arxiv.org/abs/2508.04462 ID - 2508.04462 ER -