@misc{indiciae63d85fcf631c, title = {POTSA: A Cross-Lingual Speech Alignment Framework for Speech-to-Text Translation}, author = {Xuanchen Li and Chenrui Cui and Tianrui Wang and Meng Ge and Zikang Huang and Yizhou Peng and Jin Li and Yuheng Lu and Yu Jiang and Nyima Tashi and Longbiao Wang and Jianwu Dang}, year = {2026}, url = {https://arxiv.org/abs/2511.09232}, note = {Source identifier: 2511.09232} }