@misc{indiciaef75a8ed96e48, title = {FusionSAM: Visual Multi-Modal Learning with Segment Anything}, author = {Daixun Li and Weiying Xie and Mingxiang Cao and Yunke Wang and Yusi Zhang and Leyuan Fang and Yunsong Li and Chang Xu}, year = {2025}, url = {https://arxiv.org/abs/2408.13980}, note = {Source identifier: 2408.13980} }