TY - RPRT TI - DiaDem: Advancing Dialogue Descriptions in Audiovisual Video Captioning for Multimodal Large Language Models AU - Xinlong Chen AU - Weihong Lin AU - Jingyun Hua AU - Linli Yao AU - Yue Ding AU - Bozhou Li AU - Bohan Zeng AU - Yang Shi AU - Qiang Liu AU - Yuanxing Zhang AU - Pengfei Wan AU - Liang Wang AU - Tieniu Tan PY - 2026 UR - https://arxiv.org/abs/2601.19267 ID - 2601.19267 ER -