@misc{indiciae2c372027166e, title = {Towards Unified Vision-Language Models with Incomplete Multi-Modal Inputs}, author = {Xiang Fang and Wanlong Fang and Changshuo Wang and Keke Tang and Daizong Liu and Siyi Wang and Wei Ji}, year = {2026}, url = {https://arxiv.org/abs/2605.27894}, note = {Source identifier: 2605.27894} }