@misc{indiciae4eced1852cd3, title = {UniFed-VLM: Federated Instruction Tuning for Vision-Language Models with Multiple Heterogeneity}, author = {Pengyu Wang and Baochen Xiong and Xiaoshan Yang and Yifan Xu and Zhang Qimeng and Haifeng Chen and Changsheng Xu}, year = {2026}, url = {https://arxiv.org/abs/2608.15516}, note = {Source identifier: 2608.15516} }