TY - RPRT TI - Self-Rewarding Vision-Language Model via Reasoning Decomposition AU - Zongxia Li AU - Wenhao Yu AU - Chengsong Huang AU - Zhenwen Liang AU - Rui Liu AU - Fuxiao Liu AU - Jingxi Che AU - Dian Yu AU - Jordan Boyd-Graber AU - Haitao Mi AU - Dong Yu PY - 2026 UR - https://arxiv.org/abs/2508.19652 ID - 2508.19652 ER -