Xuandong Zhao
Publication record assembled from the DBLP archive of ranked conferences.
Papers indexed
31
Venues
11
Active years
2021–2026
Best venue rank
A*
Where they publish
Papers
31 indexed papers, newest first.
| Year | Venue | Title | Authors |
|---|---|---|---|
| 2026 | ACL | Position: LLM Watermarking Should Align Stakeholders' Incentives for Practical Adoption. | Yepeng Liu, Xuandong Zhao, Dawn Song, Gregory W. Wornell, Yuheng Bu |
| 2025 | AAAI | CodeHalu: Investigating Code Hallucinations in LLMs via Execution-based Verification. | Yuchen Tian, Weixiang Yan, Qian Yang, Xuandong Zhao, Qian Chen, Wen Wang, Ziyang Luo, Lei Ma, Dawn Song |
| 2025 | ACL | Efficiently Identifying Watermarked Segments in Mixed-Source Texts. | Xuandong Zhao, Chenwen Liao, Yuxiang Wang, Lei Li |
| 2025 | EMNLP | AGENTVIGIL: Automatic Black-Box Red-teaming for Indirect Prompt Injection against LLM Agents. | Zhun Wang, Vincent Siu, Zhe Ye, Tianneng Shi, Yuzhou Nie, Xuandong Zhao, Chenguang Wang, Wenbo Guo, Dawn Song |
| 2025 | EMNLP | SafeKey: Amplifying Aha-Moment Insights for Safety Reasoning. | Kaiwen Zhou, Xuandong Zhao, Jayanth Srinivasa, Gaowen Liu, Aosong Feng, Dawn Song, Xin Eric Wang |
| 2025 | ICLR | An Undetectable Watermark for Generative Image Models. | Sam Gunn, Xuandong Zhao, Dawn Song |
| 2025 | ICLR | MMDT: Decoding the Trustworthiness and Safety of Multimodal Foundation Models. | Chejian Xu, Jiawei Zhang, Zhaorun Chen, Chulin Xie, Mintong Kang, Yujin Potter, Zhun Wang, Zhuowen Yuan, Alexander Xiong, Zidi Xiong, Chenhui Zhang, Lingzhi Yuan, Yi Zeng, Peiyang Xu, Chengquan Guo, Andy Zhou, Jeffrey Ziwei Tan, Xuandong Zhao, Francesco Pinto, Zhen Xiang, et al. |
| 2025 | ICLR | Permute-and-Flip: An optimally stable and watermarkable decoder for LLMs. | Xuandong Zhao, Lei Li, Yu-Xiang Wang |
| 2025 | ICLR | Multimodal Situational Safety. | Kaiwen Zhou, Chengzhi Liu, Xuandong Zhao, Anderson Compalas, Dawn Song, Xin Eric Wang |
| 2025 | ICML | DIS-CO: Discovering Copyrighted Content in VLMs Training Data. | Andr V. Duarte, Xuandong Zhao, Arlindo L. Oliveira, Lei Li |
| 2025 | ICML | Improving LLM Safety Alignment with Dual-Objective Optimization. | Xuandong Zhao, Will Cai, Tianneng Shi, David Huang, Licong Lin, Song Mei, Dawn Song |
| 2025 | ICML | Weak-to-Strong Jailbreaking on Large Language Models. | Xuandong Zhao, Xianjun Yang, Tianyu Pang, Chao Du, Lei Li, Yu-Xiang Wang, William Yang Wang |
| 2025 | IJCNLP | The Hidden Risks of Large Reasoning Models: A Safety Assessment of R1. | Kaiwen Zhou, Chengzhi Liu, Xuandong Zhao, Shreedhar Jangam, Jayanth Srinivasa, Gaowen Liu, Dawn Song, Xin Eric Wang |
| 2025 | NAACL | A Practical Examination of AI-Generated Text Detectors for Large Language Models. | Brian Tufts, Xuandong Zhao, Lei Li |
| 2025 | SP | SoK: Watermarking for AI-Generated Content. | Xuandong Zhao, Sam Gunn, Miranda Christ, Jaiden Fairoze, Andrs Fbrega, Nicholas Carlini, Sanjam Garg, Sanghyun Hong, Milad Nasr, Florian Tramr, Somesh Jha, Lei Li, Yu-Xiang Wang, Dawn Song |
| 2024 | ACL | GumbelSoft: Diversified Language Model Watermarking via the GumbelMax-trick. | Jiayi Fu, Xuandong Zhao, Ruihan Yang, Yuansen Zhang, Jiangjie Chen, Yanghua Xiao |
| 2024 | ACL | Pride and Prejudice: LLM Amplifies Self-Bias in Self-Refinement. | Wenda Xu, Guanglei Zhu, Xuandong Zhao, Liangming Pan, Lei Li, William Wang |
| 2024 | ACL | Watermarking for Large Language Models. | Xuandong Zhao, Yu-Xiang Wang, Lei Li |
| 2024 | CHI | Chatbot and Fatigued Driver: Exploring the Use of LLM-Based Voice Assistants for Driving Fatigue. | Shaoshuai Huang, Xuandong Zhao, Dapeng Wei, Xinheng Song, Yuanbo Sun |
| 2024 | EMNLP | MarkLLM: An Open-Source Toolkit for LLM Watermarking. | Leyi Pan, Aiwei Liu, Zhiwei He, Zitian Gao, Xuandong Zhao, Yijian Lu, Binglin Zhou, Shuliang Liu, Xuming Hu, Lijie Wen, Irwin King, Philip S. Yu |
| 2024 | EMNLP | A Survey on Detection of LLMs-Generated Content. | Xianjun Yang, Liangming Pan, Xuandong Zhao, Haifeng Chen, Linda R. Petzold, William Yang Wang, Wei Cheng |
| 2024 | ICLR | Provable Robust Watermarking for AI-Generated Text. | Xuandong Zhao, Prabhanjan Vijendra Ananth, Lei Li, Yu-Xiang Wang |
| 2024 | ICML | DE-COP: Detecting Copyrighted Content in Language Models Training Data. | Andr V. Duarte, Xuandong Zhao, Arlindo L. Oliveira, Lei Li |
| 2024 | ICML | Monitoring AI-Modified Content at Scale: A Case Study on the Impact of ChatGPT on AI Conference Peer Reviews. | Weixin Liang, Zachary Izzo, Yaohui Zhang, Haley Lepp, Hancheng Cao, Xuandong Zhao, Lingjiao Chen, Haotian Ye, Sheng Liu, Zhi Huang, Daniel A. McFarland, James Y. Zou |
| 2023 | ACL | Pre-trained Language Models Can be Fully Zero-Shot Learners. | Xuandong Zhao, Siqi Ouyang, Zhiguo Yu, Ming Wu, Lei Li |
| 2023 | ICML | Protecting Language Generation Models via Invisible Watermarking. | Xuandong Zhao, Yu-Xiang Wang, Lei Li |
| 2023 | UAI | Private Prediction Strikes Back! Private Kernelized Nearest Neighbors with Individual Rnyi Filter. | Yuqing Zhu, Xuandong Zhao, Chuan Guo, Yu-Xiang Wang |
| 2022 | ACL | Compressing Sentence Representation for Semantic Retrieval via Homomorphic Projective Distillation. | Xuandong Zhao, Zhiguo Yu, Ming Wu, Lei Li |
| 2022 | EMNLP | Distillation-Resistant Watermarking for Model Protection in NLP. | Xuandong Zhao, Lei Li, Yu-Xiang Wang |
| 2022 | NAACL | Provably Confidential Language Modelling. | Xuandong Zhao, Lei Li, Yu-Xiang Wang |
| 2021 | AISTATS | An Optimal Reduction of TV-Denoising to Adaptive Online Learning. | Dheeraj Baby, Xuandong Zhao, Yu-Xiang Wang |