@misc{indiciaee1c901c70a8e, title = {InternEvo: Efficient Long-sequence Large Language Model Training via Hybrid Parallelism and Redundant Sharding}, author = {Qiaoling Chen and Diandian Gu and Guoteng Wang and Xun Chen and YingTong Xiong and Ting Huang and Qinghao Hu and Xin Jin and Yonggang Wen and Tianwei Zhang and Peng Sun}, year = {2024}, url = {https://arxiv.org/abs/2401.09149}, note = {Source identifier: 2401.09149} }