TY - RPRT TI - Augmenting Large Audio-Language Models with Frame-Level Grounding for Fine-Grained Temporal Perception AU - Yanfeng Shi AU - Yan Song AU - Junhui Li AU - Tinggan Huang AU - Wu Guo AU - Haoyu Song AU - Ian McLoughlin PY - 2026 UR - https://arxiv.org/abs/2609.15215 ID - 2609.15215 ER -