@misc{indiciaea3a7c06fcb9a, title = {Efficient LLM inference solution on Intel GPU}, author = {Hui Wu and Yi Gan and Feng Yuan and Jing Ma and Wei Zhu and Yutao Xu and Hong Zhu and Yuhua Zhu and Xiaoli Liu and Jinghui Gu and Peng Zhao}, year = {2024}, url = {https://arxiv.org/abs/2401.05391}, note = {Source identifier: 2401.05391} }