Skip to content

Policy Filtration for RLHF to Mitigate Noise in Reward Models.

Chuheng Zhang, Wei Shen, Li Zhao, Xuyun Zhang, Xiaolong Xu, Wanchun Dou, Jiang Bian

VenueA*ICML
Year2025
ProceedingsICML

Browse the full ICML paper archive.