TY - RPRT TI - Reference-Free Reinforcement Learning Fine-Tuning for MT: A Seq2Seq Perspective AU - Ernesto Garcia-Estrada AU - Carlos Escolano AU - José A. R. Fonallosa PY - 2026 UR - https://arxiv.org/abs/2605.15976 ID - 2605.15976 ER -