TY - RPRT TI - Generation Quality-Latency Tradeoff-Aware Inference Offloading for Multimodal LLMs in Cloud-Edge Continuum AU - Zhongxiao Wang AU - Yueshen Xu AU - Xinkui Zhao AU - Wei Shao AU - Rui Li PY - 2026 UR - https://arxiv.org/abs/2606.15210 ID - 2606.15210 ER -