Skip to content

Mitigating Reward Over-Optimization in RLHF via Behavior-Supported Regularization.

Juntao Dai, Taiye Chen, Yaodong Yang, Qian Zheng, Gang Pan

VenueA*ICLR
Year2025
ProceedingsICLR

Browse the full ICLR paper archive.