| 2026 | AAAI | MirrorShield: Towards Dynamic Adaptive Defense Against Jailbreaks via Entropy-Guided Mirror Crafting. | Rui Pu, Chaozhuo Li, Rui Ha, Litian Zhang, Lirong Qiu, Xi Zhang |
| 2026 | ACL | From "Aha Moments" to Controllable Thinking: Toward Meta-Cognitive Reasoning in LRMs via Decoupled Reasoning and Control. | Rui Ha, Rui Pu, Chaozhuo Li, Li Sun, Sen Su |
| 2026 | ACL | Beyond Surface-Level Detection: Towards Cognitive-Driven Defense Against Jailbreak Attacks via Meta-Operations Reasoning. | Rui Pu, Chaozhuo Li, Rui Ha, Litian Zhang, Lirong Qiu, Xi Zhang |
| 2025 | EMNLP | DSG-MCTS: A Dynamic Strategy-Guided Monte Carlo Tree Search for Diversified Reasoning in Large Language Models. | Rui Ha, Chaozhuo Li, Rui Pu, Litian Zhang, Xi Zhang, Sen Su |
| 2025 | IJCAI | Feint and Attack: Jailbreaking and Protecting LLMs via Attention Distribution Modeling. | Rui Pu, Chaozhuo Li, Rui Ha, Zejian Chen, Litian Zhang, Zheng Liu, Lirong Qiu, Zaisheng Ye |
| 2024 | EMNLP | BaitAttack: Alleviating Intention Shift in Jailbreak Attacks via Adaptive Bait Crafting. | Rui Pu, Chaozhuo Li, Rui Ha, Litian Zhang, Lirong Qiu, Xi Zhang |