TY - RPRT TI - SAFE-QAQ: End-to-End Slow-Thinking Audio-Text Fraud Detection via Reinforcement Learning AU - Peidong Wang AU - Zhiming Ma AU - Xin Dai AU - Yongkang Liu AU - Shi Feng AU - Xiaocui Yang AU - Wenxing Hu AU - Zhihao Wang AU - Mingjun Pan AU - Li Yuan AU - Daling Wang PY - 2026 UR - https://arxiv.org/abs/2601.01392 ID - 2601.01392 ER -