TY - RPRT TI - Transcribe, Translate, and Optimize: Joint Reward Learning for Speech Translation AU - Yanghe Dong AU - Wanting Huang AU - Weiran Wang PY - 2026 UR - https://arxiv.org/abs/2609.26536 ID - 2609.26536 ER -