TY - RPRT TI - Be Faithful When Response: Returning Fluent and Grounded Answers for Vision-Language Models Reinforcement Learning AU - Peng AU - Lee AU - Yin Zhang AU - Yanglin Zhang AU - Haonan Wu AU - Zishan Liu AU - Ruoxi Zang AU - Xin Zhu AU - Jiayin Zheng AU - Jian Yao AU - Zefeng Ji AU - Fei Ma PY - 2026 UR - https://arxiv.org/abs/2606.29984 ID - 2606.29984 ER -