@misc{indiciae10fa00b234a3, title = {Towards Diverse and Efficient Audio Captioning via Diffusion Models}, author = {Manjie Xu and Chenxing Li and Xinyi Tu and Yong Ren and Ruibo Fu and Wei Liang and Dong Yu}, year = {2025}, url = {https://arxiv.org/abs/2409.09401}, note = {Source identifier: 2409.09401} }