TY - RPRT TI - Efficient Audio-Visual Speech Separation with Discrete Lip Semantics and Multi-Scale Global-Local Attention AU - Kai Li AU - Kejun Gao AU - Xiaolin Hu PY - 2026 UR - https://arxiv.org/abs/2509.23610 ID - 2509.23610 ER -