@misc{indiciae2ee080d3e765, title = {Robust Audio-Text Retrieval via Cross-Modal Attention and Hybrid Loss}, author = {Meizhu Liu and Matthew Rowe and Amit Agarwal and Michael Avendi and Yassi Abbasi and Hitesh Laxmichand Patel and Paul Li and Kyu J. Han and Tao Sheng and Sujith Ravi and Dan Roth}, year = {2026}, url = {https://arxiv.org/abs/2604.23323}, note = {Source identifier: 2604.23323} }