Skip to content

RewardDS: Privacy-Preserving Fine-Tuning for Large Language Models via Reward Driven Data Synthesis.

Jianwei Wang, Chengming Shi, Junyao Yang, Haoran Li, Qianli Ma, Huiping Zhuang, Cen Chen, Ziqian Zeng

VenueA*EMNLP
Year2025
ProceedingsEMNLP

Browse the full EMNLP paper archive.