TY - RPRT TI - Reinforcement Learning Elicits Contextual Learning of Unseen Language Translation AU - Hanxu Hu AU - Zdeněk Šnajdr AU - Pinzhen Chen AU - Jannis Vamvas AU - Rico Sennrich PY - 2026 UR - https://arxiv.org/abs/2606.06428 ID - 2606.06428 ER -