@misc{indiciae7d5d4b7087d0, title = {Learning to Decode Against Compositional Hallucination in Video Multimodal Large Language Models}, author = {Wenbin Xing and Quanxing Zha and Lizheng Zu and Mengran Li and Ming Li and Junchi Yan}, year = {2026}, url = {https://arxiv.org/abs/2602.00559}, note = {Source identifier: 2602.00559} }