TY - RPRT TI - Efficient Audio-Visual Generation via Synchrony-Aware Cross-Modal Sparse Attention AU - Shengchuan Gao AU - Teng Hu AU - Bohao Feng AU - Luchen Li AU - Wenqiang Wang AU - Hongqian Deng AU - Ran Yi PY - 2026 UR - https://arxiv.org/abs/2608.15522 ID - 2608.15522 ER -