Uncovering and Aligning Anomalous Attention Heads to Defend Against NLP Backdoor Attacks.
Haotian Jin, Yang Li, Haihui Fan, Lin Shen, Xiangfang Li, Bo Li
Browse the full AAAI paper archive.
Haotian Jin, Yang Li, Haihui Fan, Lin Shen, Xiangfang Li, Bo Li
Browse the full AAAI paper archive.