Uncertainty and Influence aware Reward Model Refinement for Reinforcement Learning from Human Feedback.
Zexu Sun, Yiju Guo, Yankai Lin, Xu Chen, Qi Qi, Xing Tang, Xiuqiang He, Ji-Rong Wen
Browse the full ICLR paper archive.
Zexu Sun, Yiju Guo, Yankai Lin, Xu Chen, Qi Qi, Xing Tang, Xiuqiang He, Ji-Rong Wen
Browse the full ICLR paper archive.