TY - RPRT TI - SeaLLM: Service-Aware and Latency-Optimized Resource Sharing for Large Language Model Inference AU - Yihao Zhao AU - Jiadun Chen AU - Peng Sun AU - Lei Li AU - Xuanzhe Liu AU - Xin Jin PY - 2025 UR - https://arxiv.org/abs/2504.15720 ID - 2504.15720 ER -