TY - RPRT TI - ToFu: Visual Tokens Reduction via Fusion for Multi-modal, Multi-patch, Multi-image Task AU - Vittorio Pippi AU - Matthieu Guillaumin AU - Silvia Cascianelli AU - Rita Cucchiara AU - Maximilian Jaritz AU - Loris Bazzani PY - 2025 UR - https://arxiv.org/abs/2503.04444 ID - 2503.04444 ER -