@misc{indiciae93447a0cabc5, title = {FlashEVA: Accelerating LLM inference via Efficient Attention}, author = {Juan Gabriel Kostelec and Qinghai Guo}, year = {2025}, url = {https://arxiv.org/abs/2511.00576}, note = {Source identifier: 2511.00576} }