| 2026 | AAAI | Bridging the Tokenizer Gap: Semantics and Distribution-aware Knowledge Transfer for Unbiased Cross-Tokenizer Distillation. | Huazheng Wang, Yongcheng Jing, Haifeng Sun, Jingyu Wang, Jianxin Liao, Leszek Rutkowski, Dacheng Tao |
| 2026 | ACL | Example Quality Matters: Multi-Aspects Example Augmentation for Private Library Programming. | Yuhao Li, Haifeng Sun, Xuesong Zhang, Shu Yao, Haoyu Zheng, Yvchuan Wang, Huazheng Wang, Zirui Zhuang, Qi Qi, Jianxin Liao, Jingyu Wang |
| 2026 | ACL | Erasing Without Remembering: Implicit Knowledge Forgetting in Large Language Models. | Huazheng Wang, Yongcheng Jing, Haifeng Sun, Yingjie Wang, Jingyu Wang, Jianxin Liao, Dacheng Tao |
| 2025 | AAAI | FCOM: A Federated Collaborative Online Monitoring Framework via Representation Learning. | Tanapol Kosolwattana, Huazheng Wang, Raed Al Kontar, Ying Lin |
| 2025 | AAAI | Efficient and Robust Reinforcement Learning from Human Feedback. | Huazheng Wang |
| 2025 | ACL | The Threat of PROMPTS in Large Language Models: A System and User Prompt Perspective. | Zixuan Xia, Haifeng Sun, Jingyu Wang, Qi Qi, Huazheng Wang, Xiaoyuan Fu, Jianxin Liao |
| 2025 | EMNLP | SimpleDoc: Multi-Modal Document Understanding with Dual-Cue Page Retrieval and Iterative Refinement. | Chelsi Jain, Yiran Wu, Yifan Zeng, Jiale Liu, Shengyu Dai, Zhenwen Shao, Qingyun Wu, Huazheng Wang |
| 2025 | EMNLP | Divide, Optimize, Merge: Scalable Fine-Grained Generative Optimization for LLM Agents. | Jiale Liu, Yifan Zeng, Shaokun Zhang, Chi Zhang, Malte Hjmark-Bertelsen, Marie Normann Gadeberg, Huazheng Wang, Qingyun Wu |
| 2025 | EMNLP | The Ranking Blind Spot: Decision Hijacking in LLM-based Text Ranking. | Yaoyao Qian, Yifan Zeng, Yuchao Jiang, Chelsi Jain, Huazheng Wang |
| 2025 | EMNLP | TreeBoN: Enhancing Inference-Time Alignment with Speculative Tree-Search and Best-of-N Sampling. | Jiahao Qiu, Yifu Lu, Yifan Zeng, Jiacheng Guo, Jiayi Geng, Chenhao Zhu, Xinzhe Juan, Ling Yang, Huazheng Wang, Kaixuan Huang, Yue Wu, Mengdi Wang |
| 2025 | EMNLP | Unveiling Internal Reasoning Modes in LLMs: A Deep Dive into Latent Reasoning vs. Factual Shortcuts with Attribute Rate Ratio. | Yiran Yang, Haifeng Sun, Jingyu Wang, Qi Qi, Zirui Zhuang, Huazheng Wang, Pengfei Ren, Jing Wang, Jianxin Liao |
| 2025 | ICLR | A Common Pitfall of Margin-based Language Model Alignment: Gradient Entanglement. | Hui Yuan, Yifan Zeng, Yue Wu, Huazheng Wang, Mengdi Wang, Liu Leqi |
| 2025 | ICML | Provably Efficient Algorithm for Best Scoring Rule Identification in Online Principal-Agent Information Acquisition. | Zichen Wang, Chuanhao Li, Huazheng Wang |
| 2025 | ICML | Which Agent Causes Task Failures and When? On Automated Failure Attribution of LLM Multi-Agent Systems. | Shaokun Zhang, Ming Yin, Jieyu Zhang, Jiale Liu, Zhiguang Han, Jingyang Zhang, Beibin Li, Chi Wang, Huazheng Wang, Yiran Chen, Qingyun Wu |
| 2025 | NAACL | Evaluating and Mitigating Object Hallucination in Large Vision-Language Models: Can They Still See Removed Objects? | Yixiao He, Haifeng Sun, Pengfei Ren, Jingyu Wang, Huazheng Wang, Qi Qi, Zirui Zhuang, Jing Wang |
| 2024 | AAAI | Tree Search-Based Evolutionary Bandits for Protein Sequence Optimization. | Jiahao Qiu, Hui Yuan, Jinghong Zhang, Wentao Chen, Huazheng Wang, Mengdi Wang |
| 2024 | AAAI | Stealthy Adversarial Attacks on Stochastic Multi-Armed Bandits. | Zhiwei Wang, Huazheng Wang, Hongning Wang |
| 2024 | ACL | SSS: Editing Factual Knowledge in Language Models towards Semantic Sparse Space. | Huazheng Wang, Haifeng Sun, Jingyu Wang, Qi Qi, Zixuan Xia, Menghao Zhang, Jianxin Liao |
| 2024 | ICLR | PARL: A Unified Framework for Policy Alignment in Reinforcement Learning from Human Feedback. | Souradip Chakraborty, Amrit Singh Bedi, Alec Koppel, Huazheng Wang, Dinesh Manocha, Mengdi Wang, Furong Huang |
| 2024 | ICML | Adversarial Attacks on Combinatorial Multi-Armed Bandits. | Rishab Balasubramanian, Jiawei Li, Prasad Tadepalli, Huazheng Wang, Qingyun Wu, Haoyu Zhao |
| 2024 | KDD | Conversational Dueling Bandits in Generalized Linear Models. | Shuhua Yang, Hui Yuan, Xiaoying Zhang, Mengdi Wang, Hong Zhang, Huazheng Wang |
| 2024 | NAACL | MDR: Model-Specific Demonstration Retrieval at Inference Time for In-Context Learning. | Huazheng Wang, Jinming Wu, Haifeng Sun, Zixuan Xia, Daixuan Cheng, Jingyu Wang, Qi Qi, Jianxin Liao |
| 2024 | UAI | Pure Exploration in Asynchronous Federated Bandits. | Zichen Wang, Chuanhao Li, Chenyu Song, Lianghui Wang, Quanquan Gu, Huazheng Wang |
| 2023 | ECAI | How Does Diffusion Influence Pretrained Language Models on Out-of-Distribution Data? | Huazheng Wang, Daixuan Cheng, Haifeng Sun, Jingyu Wang, Qi Qi, Jianxin Liao, Jing Wang, Cong Liu |
| 2023 | ICLR | Learning Kernelized Contextual Bandits in a Distributed and Asynchronous Environment. | Chuanhao Li, Huazheng Wang, Mengdi Wang, Hongning Wang |
| 2023 | ICML | Provably Efficient Representation Learning with Tractable Planning in Low-Rank POMDP. | Jiacheng Guo, Zihao Li, Huazheng Wang, Mengdi Wang, Zhuoran Yang, Xuezhou Zhang |
| 2023 | RecSys | Incentivizing Exploration in Linear Contextual Bandits under Information Gap. | Huazheng Wang, Haifeng Xu, Chuanhao Li, Zhiyuan Liu, Hongning Wang |
| 2022 | ICML | When Are Linear Stochastic Bandits Attackable? | Huazheng Wang, Haifeng Xu, Hongning Wang |
| 2022 | RecSys | Dynamic Global Sensitivity for Differentially Private Contextual Bandits. | Huazheng Wang, David Zhao, Hongning Wang |
| 2021 | WWW | PairRank: Online Pairwise Learning to Rank by Divide-and-Conquer. | Yiling Jia, Huazheng Wang, Stephen D. Guo, Hongning Wang |
| 2021 | SIGIR | Interactive Information Retrieval with Bandit Feedback. | Huazheng Wang, Yiling Jia, Hongning Wang |
| 2020 | AAAI | Incentivized Exploration for Multi-Armed Bandits under Reward Drift. | Zhiyuan Liu, Huazheng Wang, Fan Shen, Kai Liu, Lijun Chen |
| 2020 | KDD | Learning by Exploration: New Challenges in Real-World Environments. | Qingyun Wu, Huazheng Wang, Hongning Wang |
| 2020 | RecSys | Global and Local Differential Privacy for Collaborative Bandits. | Huazheng Wang, Qian Zhao, Qingyun Wu, Shubham Chopra, Abhinav Khaitan, Hongning Wang |
| 2019 | EMNLP | Adversarial Domain Adaptation for Machine Reading Comprehension. | Huazheng Wang, Zhe Gan, Xiaodong Liu, Jingjing Liu, Jianfeng Gao, Hongning Wang |
| 2019 | KDD | Factorization Bandits for Online Influence Maximization. | Qingyun Wu, Zhige Li, Huazheng Wang, Wei Chen, Hongning Wang |
| 2019 | WWW | Dynamic Ensemble of Contextual Bandits to Satisfy Users' Changing Interests. | Qingyun Wu, Huazheng Wang, Yanen Li, Hongning Wang |
| 2019 | SIGIR | Variance Reduction in Gradient Exploration for Online Learning to Rank. | Huazheng Wang, Sonwoo Kim, Eric McCord-Snook, Qingyun Wu, Hongning Wang |
| 2018 | SIGIR | Efficient Exploration of Gradient Space for Online Learning to Rank. | Huazheng Wang, Ramsey Langley, Sonwoo Kim, Eric McCord-Snook, Hongning Wang |
| 2017 | AAAI | Factorization Bandits for Interactive Recommendation. | Huazheng Wang, Qingyun Wu, Hongning Wang |
| 2016 | CIKM | Learning Hidden Features for Contextual Bandits. | Huazheng Wang, Qingyun Wu, Hongning Wang |
| 2016 | EMNLP | Solving Verbal Questions in IQ Test by Knowledge-Powered Word Embedding. | Huazheng Wang, Fei Tian, Bin Gao, Chengjieren Zhu, Jiang Bian, Tie-Yan Liu |
| 2016 | SIGIR | Contextual Bandits in a Collaborative Environment. | Qingyun Wu, Huazheng Wang, Quanquan Gu, Hongning Wang |