HARM: Learning Hate-Aware Reward Model for Evaluating Natural Language Explanations of Offensive Content.
Lorenzo Puppi Vecchi, Alceu de Souza Britto Jr., Emerson Cabrera Paraiso, Rafael M. O. Cruz
Browse the full EACL paper archive.
Lorenzo Puppi Vecchi, Alceu de Souza Britto Jr., Emerson Cabrera Paraiso, Rafael M. O. Cruz
Browse the full EACL paper archive.