Skip to content

Don't Forget Your Reward Values: Language Model Alignment via Value-based Calibration.

Xin Mao, Feng-Lin Li, Huimin Xu, Wei Zhang, Wang Chen, Anh Tuan Luu

VenueA*EMNLP
Year2024
ProceedingsEMNLP

Browse the full EMNLP paper archive.