TY - RPRT TI - RewardDS: Privacy-Preserving Fine-Tuning for Large Language Models via Reward Driven Data Synthesis AU - Jianwei Wang AU - Chengming Shi AU - Junyao Yang AU - Haoran Li AU - Qianli Ma AU - Huiping Zhuang AU - Cen Chen AU - Ziqian Zeng PY - 2025 UR - https://arxiv.org/abs/2502.18517 ID - 2502.18517 ER -