TY - RPRT TI - TLDR: Token-Level Detective Reward Model for Large Vision Language Models AU - Deqing Fu AU - Tong Xiao AU - Rui Wang AU - Wang Zhu AU - Pengchuan Zhang AU - Guan Pang AU - Robin Jia AU - Lawrence Chen PY - 2025 UR - https://arxiv.org/abs/2410.04734 ID - 2410.04734 ER -