TY - RPRT TI - LALM-as-a-Judge: Benchmarking Large Audio-Language Models for Safety Evaluation in Multi-Turn Spoken Dialogues AU - Amir Ivry AU - Shinji Watanabe PY - 2026 UR - https://arxiv.org/abs/2602.04796 ID - 2602.04796 ER -