@misc{indiciaed552d38669d0, title = {Be Faithful When Response: Returning Fluent and Grounded Answers for Vision-Language Models Reinforcement Learning}, author = {Peng and Lee and Yin Zhang and Yanglin Zhang and Haonan Wu and Zishan Liu and Ruoxi Zang and Xin Zhu and Jiayin Zheng and Jian Yao and Zefeng Ji and Fei Ma}, year = {2026}, url = {https://arxiv.org/abs/2606.29984}, note = {Source identifier: 2606.29984} }