@misc{indiciae3369b3e94bcb, title = {Opara: Exploiting Operator Parallelism for Expediting DNN Inference on GPUs}, author = {Aodong Chen and Fei Xu and Li Han and Yuan Dong and Li Chen and Zhi Zhou and Fangming Liu}, year = {2024}, url = {https://arxiv.org/abs/2312.10351}, note = {Source identifier: 2312.10351} }