| 2026 | ACL | AwarenessBench: Assessing Cognitive Capabilities of Language Models. | Xiaojian Li, Rongwu Xu, Tianyun Zhang, Yue Wang, Shuo Chen, Qiner Lyu, Briana Zhang, Peiran Yang, Kyle Xue Chen, Haoyuan Shi, Yu Wang, Wei Xu |
| 2026 | EACL | DebateQA: Evaluating Question Answering on Debatable Knowledge. | Rongwu Xu, Xuan Qi, Zehan Qi, Wei Xu, Zhijiang Guo |
| 2025 | ACL | Does Chain-of-Thought Reasoning Really Reduce Harmfulness from Jailbreaking? | Chengda Lu, Xiaoyu Fan, Yu Huang, Rongwu Xu, Jijie Li, Wei Xu |
| 2025 | ACL | Nuclear Deployed!: Analyzing Catastrophic Risks in Decision-making of Autonomous LLM Agents. | Rongwu Xu, Xiaojian Li, Shuo Chen, Wei Xu |
| 2025 | ICLR | On the Role of Attention Heads in Large Language Model Safety. | Zhenhong Zhou, Haiyang Yu, Xinghua Zhang, Rongwu Xu, Fei Huang, Kun Wang, Yang Liu, Junfeng Fang, Yongbin Li |
| 2024 | ACL | The Earth is Flat because...: Investigating LLMs' Belief towards Misinformation via Persuasive Conversation. | Rongwu Xu, Brian S. Lin, Shujian Yang, Tianqi Zhang, Weiyan Shi, Tianwei Zhang, Zhixuan Fang, Wei Xu, Han Qiu |
| 2024 | ACL | Preemptive Answer "Attacks" on Chain-of-Thought Reasoning. | Rongwu Xu, Zehan Qi, Wei Xu |
| 2024 | EMNLP | LONG²RAG: Evaluating Long-Context & Long-Form Retrieval-Augmented Generation with Key Point Recall. | Zehan Qi, Rongwu Xu, Zhijiang Guo, Cunxiang Wang, Hao Zhang, Wei Xu |
| 2024 | EMNLP | Course-Correction: Safety Alignment Using Synthetic Preferences. | Rongwu Xu, Yishuo Cai, Zhenhong Zhou, Renjie Gu, Haiqin Weng, Liu Yan, Tianwei Zhang, Wei Xu, Han Qiu |
| 2024 | EMNLP | Knowledge Conflicts for LLMs: A Survey. | Rongwu Xu, Zehan Qi, Zhijiang Guo, Cunxiang Wang, Hongru Wang, Yue Zhang, Wei Xu |
| 2024 | EMNLP | Walking in Others' Shoes: How Perspective-Taking Guides Large Language Models in Reducing Toxicity and Bias. | Rongwu Xu, Zi'an Zhou, Tianwei Zhang, Zehan Qi, Su Yao, Ke Xu, Wei Xu, Han Qiu |
| 2024 | EMNLP | Sing it, Narrate it: Quality Musical Lyrics Translation. | Zhuorui Ye, Jinhan Li, Rongwu Xu |
| 2024 | EMNLP | How Alignment and Jailbreak Work: Explain LLM Safety through Intermediate Hidden States. | Zhenhong Zhou, Haiyang Yu, Xinghua Zhang, Rongwu Xu, Fei Huang, Yongbin Li |
| 2024 | IJCNN | Exploring Chinese Humor Generation: A Study on Two-part Allegorical Sayings. | Rongwu Xu |
| 2024 | IJCNN | Tempo: Confidentiality Preservation in Cloud-Based Neural Network Training. | Rongwu Xu, Zhixuan Fang |
| 2022 | CHIIR | LifeRec: A Mobile App for Lifelog Recording and Ubiquitous Recommendation. | Jiayu Li, Hantian Zhang, Zhiyu He, Rongwu Xu, Pingfei Wu, Min Zhang, Yiqun Liu, Shaoping Ma |
| 2022 | INFOCOM | LSync: A Universal Event-synchronizing Solution for Live Streaming. | Yifan Xu, Fan Dang, Rongwu Xu, Xinlei Chen, Yunhao Liu |