| 2025 | ACL | PIGuard: Prompt Injection Guardrail via Mitigating Overdefense for Free. | Hao Li, Xiaogeng Liu, Ning Zhang, Chaowei Xiao |
| 2025 | ACL | AGrail: A Lifelong Agent Guardrail with Effective and Adaptive Safety Detection. | Weidi Luo, Shenghong Dai, Xiaogeng Liu, Suman Banerjee, Huan Sun, Muhao Chen, Chaowei Xiao |
| 2025 | ICLR | AutoDAN-Turbo: A Lifelong Agent for Strategy Self-Exploration to Jailbreak LLMs. | Xiaogeng Liu, Peiran Li, G. Edward Suh, Yevgeniy Vorobeychik, Zhuoqing Mao, Somesh Jha, Patrick McDaniel, Huan Sun, Bo Li, Chaowei Xiao |
| 2025 | ICLR | MuirBench: A Comprehensive Benchmark for Robust Multi-image Understanding. | Fei Wang, Xingyu Fu, James Y. Huang, Zekun Li, Qin Liu, Xiaogeng Liu, Mingyu Derek Ma, Nan Xu, Wenxuan Zhou, Kai Zhang, Tianyi Lorena Yan, Wenjie Jacky Mo, Hsiang-Hui Liu, Pan Lu, Chunyuan Li, Chaowei Xiao, Kai-Wei Chang, Dan Roth, Sheng Zhang, Hoifung Poon, Muhao Chen |
| 2025 | ICLR | Can Watermarks be Used to Detect LLM IP Infringement For Free? | Zhengyue Zhao, Xiaogeng Liu, Somesh Jha, Patrick McDaniel, Bo Li, Chaowei Xiao |
| 2025 | ICML | MetaAgent: Automatically Constructing Multi-Agent Systems Based on Finite State Machines. | Yaolun Zhang, Xiaogeng Liu, Chaowei Xiao |
| 2025 | NAACL | RePD: Defending Jailbreak Attack through a Retrieval-based Prompt Decomposition Process. | Peiran Wang, Xiaogeng Liu, Chaowei Xiao |
| 2025 | NAACL | CVE-Bench: Benchmarking LLM-based Software Engineering Agent's Ability to Repair Real-World CVE Vulnerabilities. | Peiran Wang, Xiaogeng Liu, Chaowei Xiao |
| 2024 | ECCV | AdaShield : Safeguarding Multimodal Large Language Models from Structure-Based Attack via Adaptive Shield Prompting. | Yu Wang, Xiaogeng Liu, Yu Li, Muhao Chen, Chaowei Xiao |
| 2024 | ICLR | AutoDAN: Generating Stealthy Jailbreak Prompts on Aligned Large Language Models. | Xiaogeng Liu, Nan Xu, Muhao Chen, Chaowei Xiao |
| 2024 | SP | Why Does Little Robustness Help? A Further Step Towards Understanding Adversarial Transferability. | Yechao Zhang, Shengshan Hu, Leo Yu Zhang, Junyu Shi, Minghui Li, Xiaogeng Liu, Wei Wan, Hai Jin |
| 2023 | CVPR | Detecting Backdoors During the Inference Stage Based on Corruption Robustness Consistency. | Xiaogeng Liu, Minghui Li, Haoyu Wang, Shengshan Hu, Dengpan Ye, Hai Jin, Libing Wu, Chaowei Xiao |
| 2022 | CVPR | Protecting Facial Privacy: Generating Adversarial Identity Masks via Style-robust Makeup Transfer. | Shengshan Hu, Xiaogeng Liu, Yechao Zhang, Minghui Li, Leo Yu Zhang, Hai Jin, Libing Wu |