TY - RPRT TI - RLHF-V: Towards Trustworthy MLLMs via Behavior Alignment from Fine-grained Correctional Human Feedback AU - Tianyu Yu AU - Yuan Yao AU - Haoye Zhang AU - Taiwen He AU - Yifeng Han AU - Ganqu Cui AU - Jinyi Hu AU - Zhiyuan Liu AU - Hai-Tao Zheng AU - Maosong Sun AU - Tat-Seng Chua PY - 2024 UR - https://arxiv.org/abs/2312.00849 ID - 2312.00849 ER -