TY - RPRT TI - Voice of Reason: Reinforcement Learning for Spoken Math AU - Timothée Weisselberger AU - Edouard Graves AU - Alexandre Défossez PY - 2026 UR - https://arxiv.org/abs/2609.18677 ID - 2609.18677 ER -