TY - RPRT TI - Training Long-Context Vision-Language Models Effectively with Generalization Beyond 128K Context AU - Zhaowei Wang AU - Lishu Luo AU - Haodong Duan AU - Weiwei Liu AU - Sijin Wu AU - Ji Luo AU - Shen Yan AU - Shuai Peng AU - Sihang Yuan AU - Chaoyi Huang AU - Yi Lin AU - Yangqiu Song PY - 2026 UR - https://arxiv.org/abs/2605.13831 ID - 2605.13831 ER -