@misc{indiciae186564064e92, title = {MA-AVT: Modality Alignment for Parameter-Efficient Audio-Visual Transformers}, author = {Tanvir Mahmud and Shentong Mo and Yapeng Tian and Diana Marculescu}, year = {2024}, url = {https://arxiv.org/abs/2406.04930}, note = {Source identifier: 2406.04930} }