Skip to content

How Can You Tell if Your Large Language Model Could Be a Closet Antisemite? An Explainability-Based Audit Framework for Implicit Bias.

Arka Dutta, Reza Fayyazi, Shanchieh Yang, Ashiqur R. KhudaBukhsh

VenueA*AAAI
Year2026
ProceedingsAAAI

Browse the full AAAI paper archive.