Skip to content

Uncertainty and Influence aware Reward Model Refinement for Reinforcement Learning from Human Feedback.

Zexu Sun, Yiju Guo, Yankai Lin, Xu Chen, Qi Qi, Xing Tang, Xiuqiang He, Ji-Rong Wen

VenueA*ICLR
Year2025
ProceedingsICLR

Browse the full ICLR paper archive.