TY - RPRT TI - Audio-DeepThinker: Progressive Reasoning-Aware Reinforcement Learning for High-Quality Chain-of-Thought Emergence in Audio Language Models AU - Xiang He AU - Chenxing Li AU - Jinting Wang AU - Yan Rong AU - Tianxin Xie AU - Wenfu Wang AU - Li Liu AU - Dong Yu PY - 2026 UR - https://arxiv.org/abs/2604.18187 ID - 2604.18187 ER -