| 2026 | ACL | False Sense of Security: Why Probing-based Malicious Input Detection Fails to Generalize. | Cheng Wang, Zeming Wei, Qin Liu, Wenxuan Zhou, Muhao Chen |
| 2025 | ICASSP | Exploring the Robustness of In-Context Learning with Noisy Labels. | Chen Cheng, Xinzhi Yu, Haodong Wen, Jingsong Sun, Guanzhang Yue, Yihao Zhang, Zeming Wei |
| 2025 | ICASSP | Boosting Jailbreak Attack with Momentum. | Yihao Zhang, Zeming Wei |
| 2025 | ICML | Identifying and Understanding Cross-Class Features in Adversarial Training. | Zeming Wei, Steven Y. Guo, Yisen Wang |
| 2024 | ESORICS | Jatmo: Prompt Injection Defense by Task-Specific Finetuning. | Julien Piet, Maha Alrashed, Chawin Sitawarin, Sizhe Chen, Zeming Wei, Elizabeth Sun, Basel Alomair, David A. Wagner |
| 2024 | ICML | On the Duality Between Sharpness-Aware Minimization and Adversarial Training. | Yihao Zhang, Hangzhou He, Jingyu Zhu, Huanran Chen, Yifei Wang, Zeming Wei |
| 2024 | SETTA | MILE: A Mutation Testing Framework of In-Context Learning Systems. | Zeming Wei, Yihao Zhang, Meng Sun |
| 2023 | CVPR | CFA: Class-Wise Calibrated Fair Adversarial Training. | Zeming Wei, Yifei Wang, Yiwen Guo, Yisen Wang |
| 2023 | SEKE | Using Z3 for Formal Modeling and Verification of FNN Global Robustness (S). | Yihao Zhang, Zeming Wei, Xiyue Zhang, Meng Sun |
| 2022 | ICFEM | Extracting Weighted Finite Automata from Recurrent Neural Networks for Natural Languages. | Zeming Wei, Xiyue Zhang, Meng Sun |