@misc{indiciaebe3d1b9232c8, title = {DOFA-CLIP: Multimodal Vision-Language Foundation Models for Earth Observation}, author = {Zhitong Xiong and Yi Wang and Weikang Yu and Adam J Stewart and Jie Zhao and Nils Lehmann and Thomas Dujardin and Zhenghang Yuan and Pedram Ghamisi and Xiao Xiang Zhu}, year = {2025}, url = {https://arxiv.org/abs/2503.06312}, note = {Source identifier: 2503.06312} }