TY - RPRT TI - Audio-Thinker: Guiding Audio Language Model When and How to Think via Reinforcement Learning AU - Shu Wu AU - Chenxing Li AU - Wenfu Wang AU - Hao Zhang AU - Hualei Wang AU - Meng Yu AU - Dong Yu PY - 2025 UR - https://arxiv.org/abs/2508.08039 ID - 2508.08039 ER -