Skip to content

Dense Reward for Free in Reinforcement Learning from Human Feedback.

Alex James Chan, Hao Sun, Samuel Holt, Mihaela van der Schaar

VenueA*ICML
Year2024
ProceedingsICML

Browse the full ICML paper archive.