@misc{indiciaea87209eeeb22, title = {ViGoR: Improving Visual Grounding of Large Vision Language Models with Fine-Grained Reward Modeling}, author = {Siming Yan and Min Bai and Weifeng Chen and Xiong Zhou and Qixing Huang and Li Erran Li}, year = {2025}, url = {https://arxiv.org/abs/2402.06118}, note = {Source identifier: 2402.06118} }