TY - RPRT TI - Optimizing Conversational Quality in Spoken Dialogue Systems with Reinforcement Learning from AI Feedback AU - Siddhant Arora AU - Jinchuan Tian AU - Jiatong Shi AU - Hayato Futami AU - Yosuke Kashiwagi AU - Emiru Tsunoo AU - Shinji Watanabe PY - 2026 UR - https://arxiv.org/abs/2601.19063 ID - 2601.19063 ER -