Skip to content

Taming Overconfidence in LLMs: Reward Calibration in RLHF.

Jixuan Leng, Chengsong Huang, Banghua Zhu, Jiaxin Huang

VenueA*ICLR
Year2025
ProceedingsICLR

Browse the full ICLR paper archive.