Skip to content

Teach a Reward Model to Correct Itself: Reward Guided Adversarial Failure Discovery for Robust Reward Modeling.

Pankayaraj Pathmanathan, Furong Huang

VenueA*ACL
Year2026
ProceedingsACL (1)

Browse the full ACL paper archive.