@misc{indiciae66aa50173327, title = {CCStereo: Audio-Visual Contextual and Contrastive Learning for Binaural Audio Generation}, author = {Yuanhong Chen and Kazuki Shimada and Christian Simon and Yukara Ikemiya and Takashi Shibuya and Yuki Mitsufuji}, year = {2025}, doi = {10.1145/3746027.3754919}, url = {https://arxiv.org/abs/2501.02786}, note = {Source identifier: 2501.02786} }