TY - RPRT TI - Attention or Convolution: Transformer Encoders in Audio Language Models for Inference Efficiency AU - Sungho Jeon AU - Ching-Feng Yeh AU - Hakan Inan AU - Wei-Ning Hsu AU - Rashi Rungta AU - Yashar Mehdad AU - Daniel Bikel PY - 2024 UR - https://arxiv.org/abs/2311.02772 ID - 2311.02772 ER -