TY - RPRT TI - JoVA: Unified Multimodal Learning for Joint Video-Audio Generation and Editing AU - Xiaohu Huang AU - Haoyang He AU - Hao Zhou AU - Qiangpeng Yang AU - Shilei Wen AU - Kai Han PY - 2026 UR - https://arxiv.org/abs/2512.13677 ID - 2512.13677 ER -