@misc{indiciae1e1f37f053c0, title = {Reinforcement Learning with Semantic Rewards Enables Low-Resource Language Expansion without Alignment Tax}, author = {Zeli Su and Ziyin Zhang and Zhou Liu and Xuexian Song and Zhankai Xu and Longfei Zheng and Xiaolu Zhang and Rong Fu and Guixian Xu and Wentao Zhang}, year = {2026}, url = {https://arxiv.org/abs/2605.14366}, note = {Source identifier: 2605.14366} }