TY - RPRT TI - SpeakerLM: End-to-End Versatile Speaker Diarization and Recognition with Multimodal Large Language Models AU - Han Yin AU - Yafeng Chen AU - Chong Deng AU - Luyao Cheng AU - Hui Wang AU - Chao-Hong Tan AU - Qian Chen AU - Wen Wang AU - Xiangang Li PY - 2026 UR - https://arxiv.org/abs/2508.06372 ID - 2508.06372 ER -