@misc{indiciaeecd1f4a89619, title = {MaTVLM: Hybrid Mamba-Transformer for Efficient Vision-Language Modeling}, author = {Yingyue Li and Bencheng Liao and Wenyu Liu and Xinggang Wang}, year = {2025}, url = {https://arxiv.org/abs/2503.13440}, note = {Source identifier: 2503.13440} }