Skip to content

HARM: Learning Hate-Aware Reward Model for Evaluating Natural Language Explanations of Offensive Content.

Lorenzo Puppi Vecchi, Alceu de Souza Britto Jr., Emerson Cabrera Paraiso, Rafael M. O. Cruz

VenueAEACL
Year2026
ProceedingsEACL (Findings)

Browse the full EACL paper archive.