@misc{indiciae3cca4107764a, title = {EndoVLM: An Endoscopy Vision-Language Pre-training Model via Anatomy-Guided Sparsity and Progressive Alignment}, author = {Zhenyu Yi and Jianwei Xu and Yue Hu and Zhongwei Qiu and Sijing Li and Liang Huang and Bin Lv and Ling Zhang and Yingda Xia}, year = {2026}, url = {https://arxiv.org/abs/2608.04472}, note = {Source identifier: 2608.04472} }