TY - RPRT TI - PAT: Accelerating LLM Decoding via Prefix-Aware Attention with Resource Efficient Multi-Tile Kernel AU - Jinjun Yi AU - Zhixin Zhao AU - Yitao Hu AU - Ke Yan AU - Weiwei Sun AU - Hao Wang AU - Laiping Zhao AU - Yuhao Zhang AU - Wenxin Li AU - Keqiu Li PY - 2026 DO - 10.1145/3779212.3790200 UR - https://arxiv.org/abs/2511.22333 ID - 2511.22333 ER -