TY - RPRT TI - DuraS2ST: Chain-of-Thought and Reinforcement Learning for Duration-Aligned Speech-to-Speech Translation AU - Yayue Deng AU - Dingdong Wang AU - Yuxuan Hu AU - Jinyu Li AU - Yanqing Liu AU - Yuanyuan Wang AU - Weidong Chen AU - Helen M. Meng AU - Shujie Liu AU - Xixin Wu PY - 2026 UR - https://arxiv.org/abs/2609.33742 ID - 2609.33742 ER -