Skip to content

Confident, Calibrated, or Complicit: Safety Alignment and Ideological Bias in LLM Hate Speech Detection.

Sanjeevan Selvaganapathy, Mehwish Nasim

VenueA*ACL
Year2026
ProceedingsACL (1)

Browse the full ACL paper archive.