@misc{indiciae4a6587d8c3da, title = {Aligned Better, Listen Better for Audio-Visual Large Language Models}, author = {Yuxin Guo and Shuailei Ma and Shijie Ma and Xiaoyi Bao and Chen-Wei Xie and Kecheng Zheng and Tingyu Weng and Siyang Sun and Yun Zheng and Wei Zou}, year = {2025}, url = {https://arxiv.org/abs/2504.02061}, note = {Source identifier: 2504.02061} }