@misc{indiciae01c864e9b104, title = {From Curated Data to Scalable Models: Continual Pre-training of Dense and MoE Large Language Models for Tibetan}, author = {Lei Yang and Leiyu Pan and Bojian Xiong and Renren Jin and Shaowei Zhang and Yue Chen and Ling Shi and Jiang Zhou and Junru Wu and Zhen Wang and Jianxiang Peng and Juesi Xiao and Tianyu Dong and Zhuowen Han and Zhuo Chen and Yuqi Ren and Deyi Xiong}, year = {2026}, url = {https://arxiv.org/abs/2507.09205}, note = {Source identifier: 2507.09205} }