@misc{indiciae0a887d09a387, title = {Mid-Training Language Models on Raw Video}, author = {Jaedong Hwang and Xiaoqian Shen and Ernie Chang and Changsheng Zhao and Chong Zhou and Saksham Suri and Qi Qian and Zechun Liu and Lemeng Wu and Qinsi Wang and Raghuraman Krishnamoorthi and Wei Wen}, year = {2026}, url = {https://arxiv.org/abs/2610.11019}, note = {Source identifier: 2610.11019} }