| 2025 | ACL | Understanding Silent Data Corruption in LLM Training. | Jeffrey Jian Ma, Hengzhi Pei, Leonard Lausen, George Karypis |
| 2025 | IOLTS | When Silicon Fails Silently: Characterizing Hardware-Induced Corruption in LLM Training. | Jeffrey Jian Ma, Hengzhi Pei, Leonard Lausen, George Karypis |
| 2024 | ACL | Fine-tuning Language Models for Joint Rewriting and Completion of Code with Potential Bugs. | Dingmin Wang, Jinman Zhao, Hengzhi Pei, Samson Tan, Sheng Zha |
| 2024 | NDSS | TextGuard: Provable Defense against Backdoor Attacks on Text Classification. | Hengzhi Pei, Jinyuan Jia, Wenbo Guo, Bo Li, Dawn Song |
| 2023 | AAAI | Better Context Makes Better Code Language Models: A Case Study on Function Call Argument Completion. | Hengzhi Pei, Jinman Zhao, Leonard Lausen, Sheng Zha, George Karypis |
| 2023 | ACL | Zero-Shot Classification by Logical Reasoning on Natural Language Explanations. | Chi Han, Hengzhi Pei, Xinya Du, Heng Ji |
| 2021 | ICDM | Towards Generating Real-World Time Series Data. | Hengzhi Pei, Kan Ren, Yuqing Yang, Chang Liu, Tao Qin, Dongsheng Li |
| 2020 | AAAI | Reinforcement-Learning Based Portfolio Management with Augmented Asset Movement Prediction States. | Yunan Ye, Hengzhi Pei, Boxin Wang, Pin-Yu Chen, Yada Zhu, Ju Xiao, Bo Li |
| 2020 | CVPR | The Secret Revealer: Generative Model-Inversion Attacks Against Deep Neural Networks. | Yuheng Zhang, Ruoxi Jia, Hengzhi Pei, Wenxiao Wang, Bo Li, Dawn Song |
| 2020 | EMNLP | A Concise Model for Multi-Criteria Chinese Word Segmentation with Transformer Encoder. | Xipeng Qiu, Hengzhi Pei, Hang Yan, Xuanjing Huang |
| 2020 | EMNLP | T3: Tree-Autoencoder Constrained Adversarial Text Generation for Targeted Attack. | Boxin Wang, Hengzhi Pei, Boyuan Pan, Qian Chen, Shuohang Wang, Bo Li |