Skip to content

Large Language Models Are Involuntary Truth-Tellers: Exploiting Fallacy Failure for Jailbreak Attacks.

Yue Zhou, Henry Peng Zou, Barbara Di Eugenio, Yang Zhang

VenueA*EMNLP
Year2024
ProceedingsEMNLP

Browse the full EMNLP paper archive.