An LLM can Fool Itself: A Prompt-Based Adversarial Attack.
Xilie Xu, Keyi Kong, Ning Liu, Lizhen Cui, Di Wang, Jingfeng Zhang, Mohan S. Kankanhalli
Browse the full ICLR paper archive.
Xilie Xu, Keyi Kong, Ning Liu, Lizhen Cui, Di Wang, Jingfeng Zhang, Mohan S. Kankanhalli
Browse the full ICLR paper archive.