| 2026 | AAAI | PhysPatch: A Physically Realizable and Transferable Adversarial Patch Attack for Multimodal Large Language Models-based Autonomous Driving Systems. | Qi Guo, Xiaojun Jia, Shanmin Pang, Simeng Qin, Lin Wang, Ju Jia, Yang Liu, Qing Guo |
| 2026 | AAAI | GeoShield: Safeguarding Geolocation Privacy from Vision-Language Models via Adversarial Perturbations. | Xinwei Liu, Xiaojun Jia, Yuan Xun, Simeng Qin, Xiaochun Cao |
| 2026 | AAAI | The Emotional Baby Is Truly Deadly: Does Your Multimodal Large Reasoning Model Have Emotional Flattery Towards Humans? | Yuan Xun, Xiaojun Jia, Xinwei Liu, Simeng Qin, Hua Zhang |
| 2026 | AAAI | AsFT: Anchoring Safety During LLM Fine-Tuning Within Narrow Safety Basin. | Shuo Yang, Qihui Zhang, Yuyang Liu, Yue Huang, Xiaojun Jia, Kun-Peng Ning, Jia-Yu Yao, Jigang Wang, Hailiang Dai, Yibing Song, Li Yuan |
| 2026 | AAAI | MPAS: Breaking Sequential Constraints of Multi-Agent Communication Topologies via Individual-Epistemic Message Propagation. | Jingxuan Yu, Ju Jia, Simeng Qin, Xiaojun Jia, Siqi Ma, Yihao Huang, Yali Yuan, Guang Cheng |
| 2026 | ACL | Know Thy Enemy: Securing LLMs Against Prompt Injection via Diverse Data Synthesis and Instruction-Level Chain-of-Thought Learning. | Zhiyuan Chang, Mingyang Li, Yuekai Huang, Ziyou Jiang, Xiaojun Jia, Qian Xiong, Junjie Wang, Zhaoyang Li, Qing Wang |
| 2026 | ACL | GAMBIT: A Gamified Jailbreak Framework for Multimodal Large Language Models. | Xiangdong Hu, Yangyang Jiang, Qin Hu, Xiaojun Jia |
| 2026 | ACL | Towards Identification and Intervention of Safety-Critical Parameters in Large Language Models. | Weiwei Qi, Zefeng Wu, Tianhang Zheng, Zikang Zhang, Xiaojun Jia, Zhan Qin, Kui Ren |
| 2026 | DASFAA | Buster: Implanting Semantic Backdoor Into Text Encoder to Mitigate NSFW Content Generation. | Xin Zhao, Xiaojun Chen, Yuexin Xuan, Zhendong Zhao, Xinfeng Li, Xiaojun Jia, Xiaofeng Wang |
| 2026 | KDD | EmoRAG: Evaluating RAG Robustness to Symbolic Perturbations. | Xinyun Zhou, Xinfeng Li, Yinan Peng, Ming Xu, Xuanwang Zhang, Miao Yu, Yidong Wang, Xiaojun Jia, Kun Wang, Qingsong Wen, XiaoFeng Wang, Wei Dong |
| 2026 | NDSS | Odysseus: Jailbreaking Commercial Multimodal LLM-integrated Systems via Dual Steganography. | Songze Li, Jiameng Cheng, Yiming Li, Xiaojun Jia, Dacheng Tao |
| 2026 | SP | WebCloak: Characterizing and Mitigating Threats From LLM-Driven Web Agents as Intelligent Scrapers. | Xinfeng Li, Tianze Qiu, Yingbin Jin, Lixu Wang, Hanqing Guo, Xiaojun Jia, Xiaofeng Wang, Wei Dong |
| 2025 | AAAI | Perception-Guided Jailbreak Against Text-to-Image Models. | Yihao Huang, Le Liang, Tianlin Li, Xiaojun Jia, Run Wang, Weikai Miao, Geguang Pu, Yang Liu |
| 2025 | ACL | Efficient Universal Goal Hijacking with Semantics-guided Prompt Organization. | Yihao Huang, Chong Wang, Xiaojun Jia, Qing Guo, Felix Juefei-Xu, Jian Zhang, Yang Liu, Geguang Pu |
| 2025 | ACL | Crabs: Consuming Resource via Auto-generation for LLM-DoS Attack under Black-box Settings. | Yuanhe Zhang, Zhenhong Zhou, Wei Zhang, Xinyue Wang, Xiaojun Jia, Yang Liu, Sen Su |
| 2025 | EMNLP | One Shot Dominance: Knowledge Poisoning Attack on Retrieval-Augmented Generation Systems. | Zhiyuan Chang, Mingyang Li, Xiaojun Jia, Junjie Wang, Yuekai Huang, Ziyou Jiang, Yang Liu, Qing Wang |
| 2025 | EMNLP | PBI-Attack: Prior-Guided Bimodal Interactive Black-Box Jailbreak Attack for Toxicity Maximization. | Ruoxi Cheng, Yizhong Ding, Shuirong Cao, Ranjie Duan, Xiaoshuang Jia, Shaowei Yuan, Simeng Qin, Zhiqiang Wang, Xiaojun Jia |
| 2025 | EMNLP | LLM Jailbreak Detection for (Almost) Free! | Guorui Chen, Yifan Xia, Xiaojun Jia, Zhijiang Li, Philip Torr, Jindong Gu |
| 2025 | ICCV | AutoPrompt: Automated Red-Teaming of Text-to-Image Models via LLM-Driven Adversarial Prompts. | Yufan Liu, Wanqian Zhang, Huashan Chen, Lin Wang, Xiaojun Jia, Zheng Lin, Weiping Wang |
| 2025 | ICCV | 3D Gaussian Splatting Driven Multi-View Robust Physical Adversarial Camouflage Generation. | Tianrui Lou, Xiaojun Jia, Siyuan Liang, Jiawei Liang, Ming Zhang, Yanjun Xiao, Xiaochun Cao |
| 2025 | ICCV | Heuristic-Induced Multimodal Risk Distribution Jailbreak Attack for Multimodal Large Language Models. | Teng Ma, Xiaojun Jia, Ranjie Duan, Xinfeng Li, Yihao Huang, Xiaoshuang Jia, Zhixuan Chu, Wenqi Ren |
| 2025 | ICCV | Accelerate 3D Object Detection Models via Zero-Shot Attention Key Pruning. | Lizhen Xu, Xiuxiu Bai, Xiaojun Jia, Jianwu Fang, Shanmin Pang |
| 2025 | ICLR | Improved Techniques for Optimization-Based Jailbreaking on Large Language Models. | Xiaojun Jia, Tianyu Pang, Chao Du, Yihao Huang, Jindong Gu, Yang Liu, Xiaochun Cao, Min Lin |
| 2025 | ICML | DAMA: Data- and Model-aware Alignment of Multi-modal LLMs. | Jinda Lu, Junkang Wu, Jinghan Li, Xiaojun Jia, Shuo Wang, Yifan Zhang, Junfeng Fang, Xiang Wang, Xiangnan He |
| 2025 | ICML | Cannot See the Forest for the Trees: Invoking Heuristics and Biases to Elicit Irrational Choices of LLMs. | Haoming Yang, Ke Ma, Xiaojun Jia, Yingfei Sun, Qianqian Xu, Qingming Huang |
| 2025 | SIGIR | PATFinger: Prompt-Adapted Transferable Fingerprinting against Unauthorized Multimodal Dataset Usage. | Wenyi Zhang, Ju Jia, Xiaojun Jia, Yihao Huang, Xinfeng Li, Cong Wu, Lina Wang |
| 2024 | AAAI | Does Few-Shot Learning Suffer from Backdoor Attacks? | Xinwei Liu, Xiaojun Jia, Jindong Gu, Yuan Xun, Siyuan Liang, Xiaochun Cao |
| 2024 | CVPR | Hide in Thicket: Generating Imperceptible and Rational Adversarial Perturbations on 3D Point Clouds. | Tianrui Lou, Xiaojun Jia, Jindong Gu, Li Liu, Siyuan Liang, Bangyan He, Xiaochun Cao |
| 2024 | ECCV | Boosting Transferability in Vision-Language Attacks via Diversification Along the Intersection Region of Adversarial Trajectory. | Sensen Gao, Xiaojun Jia, Xuhong Ren, Ivor W. Tsang, Qing Guo |
| 2024 | ICLR | Poisoned Forgery Face: Towards Backdoor Attacks on Face Forgery Detection. | Jiawei Liang, Siyuan Liang, Aishan Liu, Xiaojun Jia, Junhao Kuang, Xiaochun Cao |
| 2023 | AAAI | Generating Transferable 3D Adversarial Point Cloud via Random Perturbation Factorization. | Bangyan He, Jian Liu, Yiming Li, Siyuan Liang, Jingzhi Li, Xiaojun Jia, Xiaochun Cao |
| 2023 | CVPR | Universal Watermark Vaccine: Universal Adversarial Perturbations for Watermark Protection. | Jianbo Chen, Xinwei Liu, Siyuan Liang, Xiaojun Jia, Yuan Xun |
| 2023 | ICLR | Inequality phenomenon in l | Ranjie Duan, Yuefeng Chen, Yao Zhu, Xiaojun Jia, Rong Zhang, Hui Xue |
| 2023 | Interspeech | Robust Automatic Speech Recognition via WavAugment Guided Phoneme Adversarial Training. | Gege Qi, Yuefeng Chen, Xiaofeng Mao, Xiaojun Jia, Ranjie Duan, Rong Zhang, Hui Xue |
| 2022 | AAAI | Defending against Model Stealing via Verifying Embedded External Features. | Yiming Li, Linghui Zhu, Xiaojun Jia, Yong Jiang, Shu-Tao Xia, Xiaochun Cao |
| 2022 | CVPR | LAS-AT: Adversarial Training with Learnable Attack Strategy. | Xiaojun Jia, Yong Zhang, Baoyuan Wu, Ke Ma, Jue Wang, Xiaochun Cao |
| 2022 | ECCV | Prior-Guided Adversarial Initialization for Fast Adversarial Training. | Xiaojun Jia, Yong Zhang, Xingxing Wei, Baoyuan Wu, Ke Ma, Jue Wang, Xiaochun Cao |
| 2022 | ECCV | A Large-Scale Multiple-objective Method for Black-box Attack Against Object Detection. | Siyuan Liang, Longkang Li, Yanbo Fan, Xiaojun Jia, Jingzhi Li, Baoyuan Wu, Xiaochun Cao |
| 2022 | ECCV | Watermark Vaccine: Adversarial Attacks to Prevent Watermark Removal. | Xinwei Liu, Jian Liu, Yang Bai, Jindong Gu, Tao Chen, Xiaojun Jia, Xiaochun Cao |
| 2019 | CVPR | ComDefend: An Efficient Image Compression Model to Defend Adversarial Examples. | Xiaojun Jia, Xingxing Wei, Xiaochun Cao, Hassan Foroosh |