@misc{indiciae60c6aa936aab, title = {Generation Quality-Latency Tradeoff-Aware Inference Offloading for Multimodal LLMs in Cloud-Edge Continuum}, author = {Zhongxiao Wang and Yueshen Xu and Xinkui Zhao and Wei Shao and Rui Li}, year = {2026}, url = {https://arxiv.org/abs/2606.15210}, note = {Source identifier: 2606.15210} }