| 2026 | AAAI | Eguard: Defending LLM Embeddings Against Inversion Attacks via Text Mutual Information Optimization. | Tiantian Liu, Hongwei Yao, Feng Lin, Tong Wu, Zhan Qin, Kui Ren |
| 2026 | WWW | Reading Between the Lines: Towards Reliable Black-box LLM Fingerprinting via Zeroth-order Gradient Estimation. | Shuo Shao, Yiming Li, Hongwei Yao, Yifei Chen, Yuchen Yang, Zhan Qin |
| 2026 | WWW | Combating Knowledge Corruption in Agent Systems: A Byzantine-Tolerant Secure Collaborative RAG Framework. | Zhaoqi Wang, Daqing He, Zijian Zhang, Ye Liu, Jiamou Liu, Zhirui Zeng, Zhan Qin, Zhen Li, Xin Li, Hongwei Yao, Jincheng An, Yong Liu, Yi Li, Qi Sun, Xiulei Liu, Liehuang Zhu |
| 2026 | SP | PromptCOS: Towards Content-Only System Prompt Copyright Auditing for LLMs. | Yuchen Yang, Yiming Li, Hongwei Yao, Enhao Huang, Shuo Shao, Yuyi Wang, Zhibo Wang, Dacheng Tao, Zhan Qin |
| 2025 | NDSS | Explanation as a Watermark: Towards Harmless and Multi-bit Model Ownership Verification via Watermarking Feature Attribution. | Shuo Shao, Yiming Li, Hongwei Yao, Yiling He, Zhan Qin, Kui Ren |
| 2024 | ICASSP | PoisonPrompt: Backdoor Attack on Prompt-Based Large Language Models. | Hongwei Yao, Jian Lou, Zhan Qin |
| 2024 | SP | PromptCARE: Prompt Copyright Protection by Watermark Injection and Verification. | Hongwei Yao, Jian Lou, Zhan Qin, Kui Ren |