TY - RPRT TI - Towards Expressive and Faithful Audio-to-Image Generation: A Unified Multimodal Dataset and Synthesis Framework AU - Dongxu Ge AU - Shansong Liu AU - Cheng Gong AU - Xiao-Lei Zhang AU - Chi Zhang AU - Xuelong Li PY - 2026 DO - 10.1145/3767308.3836313 UR - https://arxiv.org/abs/2608.09529 ID - 2608.09529 ER -