Skip to content

Intrinsic Model Weaknesses: How Priming Attacks Unveil Vulnerabilities in Large Language Models.

Yuyi Huang, Runzhe Zhan, Derek F. Wong, Lidia S. Chao, Ailin Tao

VenueANAACL
Year2025
ProceedingsNAACL (Findings)

Browse the full NAACL paper archive.