Skip to content

Feint and Attack: Jailbreaking and Protecting LLMs via Attention Distribution Modeling.

Rui Pu, Chaozhuo Li, Rui Ha, Zejian Chen, Litian Zhang, Zheng Liu, Lirong Qiu, Zaisheng Ye

VenueA*IJCAI
Year2025
ProceedingsIJCAI

Browse the full IJCAI paper archive.