@misc{indiciae88248fec744a, title = {LycheeDecode: Accelerating Long-Context LLM Inference via Hybrid-Head Sparse Decoding}, author = {Gang Lin and Dongfang Li and Zhuoen Chen and Yukun Shi and Xuhui Chen and Baotian Hu and Min Zhang}, year = {2026}, url = {https://arxiv.org/abs/2602.04541}, note = {Source identifier: 2602.04541} }