@misc{indiciae95c799ada365, title = {SpotSound: Enhancing Large Audio-Language Models with Fine-Grained Temporal Grounding}, author = {Luoyi Sun and Xiao Zhou and Zeqian Li and Ya Zhang and Yanfeng Wang and Weidi Xie}, year = {2026}, url = {https://arxiv.org/abs/2604.13023}, note = {Source identifier: 2604.13023} }