TY - RPRT TI - Sound2Vision: Generating Diverse Visuals from Audio through Cross-Modal Latent Alignment AU - Kim Sung-Bin AU - Arda Senocak AU - Hyunwoo Ha AU - Tae-Hyun Oh PY - 2024 UR - https://arxiv.org/abs/2412.06209 ID - 2412.06209 ER -