TY - RPRT TI - Training Language Models to Generate Text with Citations via Fine-grained Rewards AU - Chengyu Huang AU - Zeqiu Wu AU - Yushi Hu AU - Wenya Wang PY - 2024 UR - https://arxiv.org/abs/2402.04315 ID - 2402.04315 ER -