@misc{indiciae237072c4728e, title = {Aligning Modalities in Vision Large Language Models via Preference Fine-tuning}, author = {Yiyang Zhou and Chenhang Cui and Rafael Rafailov and Chelsea Finn and Huaxiu Yao}, year = {2024}, url = {https://arxiv.org/abs/2402.11411}, note = {Source identifier: 2402.11411} }