| 2026 | ACL | Beneficial Reasoning Behaviors in Agentic Search and Effective Training Methods to Obtain Them. | Jiahe Jin, Abhijay Sai Paladugu, Chenyan Xiong |
| 2026 | ACL | Efficient Multi-Agent System Training with Data Influence-Oriented Tree Search. | Wentao Shi, Zichun Yu, Fuli Feng, Xiangnan He, Chenyan Xiong |
| 2026 | EACL | Linking Knowledge to Care: Knowledge Graph-Augmented Medical Follow-Up Question Generation. | Liwen Sun, Xiang Yu, Ming Tan, Zhuohao Chen, Anqi Cheng, Ashutosh Joshi, Chenyan Xiong |
| 2026 | EACL | ThinkNote: Enhancing Knowledge Integration and Utilization of Large Language Models via Constructivist Cognition Modeling. | Zhipeng Xu, Zhenghao Liu, Yukun Yan, Shuo Wang, Shi Yu, Zheni Zeng, Chaojun Xiao, Zhiyuan Liu, Ge Yu, Chenyan Xiong |
| 2026 | ICTIR | DeepResearchGym: A Free, Transparent, and Reproducible Sandbox for Deep Research. | Joo Coelho, Jingjie Ning, Jingyuan He, Kangrui Mao, Abhijay Sai Paladugu, Pranav Setlur, Jiahe Jin, Jamie Callan, Joo Magalhes, Bruno Martins, Chenyan Xiong |
| 2026 | KDD | LISRec: Modeling User Preferences with Learned Item Shortcuts for Sequential Recommendation. | Haidong Xin, Zhenghao Liu, Sen Mei, Yukun Yan, Shi Yu, Shuo Wang, Zulong Chen, Yu Gu, Ge Yu, Chenyan Xiong |
| 2026 | WWW | Deep Research Comparator: A Platform For Fine-grained Human Annotations of Deep Research Agents. | Prahaladh Chandrahasan, Jiahe Jin, Zhihan Zhang, Tevin Wang, Andy Tang, Lucy Mo, Morteza Ziyadi, Leonardo F. R. Ribeiro, Zimeng Qiu, Markus Dreyer, Akari Asai, Chenyan Xiong |
| 2026 | SIGIR | Agentic Search in the Wild: Intents and Trajectory Dynamics from 14M+ Real Search Requests. | Jingjie Ning, Joo Coelho, Yibo Kong, Yunfan Long, Bruno Martins, Joo Magalhes, Jamie Callan, Chenyan Xiong |
| 2025 | ACL | Craw4LLM: Efficient Web Crawling for LLM Pretraining. | Shi Yu, Zhiyuan Liu, Chenyan Xiong |
| 2025 | ACL | Understand User Opinions of Large Language Models via LLM-Powered In-the-Moment User Experience Interviews. | Mengqiao Liu, Tevin Wang, Cassandra A. Cohen, Sarah Li, Chenyan Xiong |
| 2025 | EMNLP | ResearchArena: Benchmarking Large Language Models' Ability to Collect and Organize Information as Research Agents. | Hao Kang, Chenyan Xiong |
| 2025 | ICLR | RAG-DDR: Optimizing Retrieval-Augmented Generation Using Differentiable Data Rewards. | Xinze Li, Sen Mei, Zhenghao Liu, Yukun Yan, Shuo Wang, Shi Yu, Zheni Zeng, Hao Chen, Ge Yu, Zhiyuan Liu, Maosong Sun, Chenyan Xiong |
| 2025 | ICLR | Harnessing Webpage UIs for Text-Rich Visual Understanding. | Junpeng Liu, Tianyue Ou, Yifan Song, Yuxiao Qu, Wai Lam, Chenyan Xiong, Wenhu Chen, Graham Neubig, Xiang Yue |
| 2025 | ICLR | Montessori-Instruct: Generate Influential Training Data Tailored for Student Learning. | Xiaochuan Li, Zichun Yu, Chenyan Xiong |
| 2025 | NAACL | On the Feasibility of In-Context Probing for Data Attribution. | Cathy Jiao, Weizhen Gao, Aditi Raghunathan, Chenyan Xiong |
| 2025 | NAACL | Interpret and Control Dense Retrieval with Sparse Latent Features. | Hao Kang, Tevin Wang, Chenyan Xiong |
| 2025 | NAACL | Fact-Aware Multimodal Retrieval Augmentation for Accurate Medical Radiology Report Generation. | Liwen Sun, James (Jialun) Zhao, Wenjing Han, Chenyan Xiong |
| 2025 | SIGIR | Aligning Web Query Generation with Ranking Objectives via Direct Preference Optimization. | Joo Coelho, Bruno Martins, Joo Magalhes, Chenyan Xiong |
| 2024 | ACL | Dwell in the Beginning: How Language Models Embed Long Documents for Dense Retrieval. | Joo Coelho, Bruno Martins, Joo Magalhes, Jamie Callan, Chenyan Xiong |
| 2024 | ACL | MARVEL: Unlocking the Multi-Modal Capability of Dense Retrieval via Visual Module Plugin. | Tianshuo Zhou, Sen Mei, Xinze Li, Zhenghao Liu, Chenyan Xiong, Zhiyuan Liu, Yu Gu, Ge Yu |
| 2024 | COLING | Fusion-in-T5: Unifying Variant Signals for Simple and Effective Document Ranking with Attention Fusion. | Shi Yu, Chenghao Fan, Chenyan Xiong, David Jin, Zhiyuan Liu, Zhenghao Liu |
| 2024 | EMNLP | RAGViz: Diagnose and Visualize Retrieval-Augmented Generation. | Tevin Wang, Jingyuan He, Chenyan Xiong |
| 2024 | ICML | ED-Copilot: Reduce Emergency Department Wait Time with Language Model Diagnostic Assistance. | Liwen Sun, Abhineet Agarwal, Aaron Kornblith, Bin Yu, Chenyan Xiong |
| 2024 | NAACL | Toolink: Linking Toolkit Creation and Using through Chain-of-Solving on Open-Source Model. | Cheng Qian, Chenyan Xiong, Zhenghao Liu, Zhiyuan Liu |
| 2024 | WWW | MS MARCO Web Search: A Large-scale Information-rich Web Dataset with Millions of Real Click Labels. | Qi Chen, Xiubo Geng, Corby Rosset, Carolyn Buractaon, Jingwen Lu, Tao Shen, Kun Zhou, Chenyan Xiong, Yeyun Gong, Paul N. Bennett, Nick Craswell, Xing Xie, Fan Yang, Bryan Tower, Nikhil Rao, Anlei Dong, Wenqi Jiang, Zheng Liu, Mingqin Li, Chuanjie Liu, Zengzhong Li, Rangan Majumder, Jennifer Neville, Andy Oakley, Knut Magne Risvik, Harsha Vardhan Simhadri, Manik Varma, Yujing Wang, Linjun Yang, Mao Yang, Ce Zhang |
| 2023 | ACL | Model-Generated Pretraining Signals Improves Zero-Shot Generalization of Text-to-Text Transformers. | Linyuan Gong, Chenyan Xiong, Xiaodong Liu, Payal Bajaj, Yiqing Xie, Alvin Cheung, Jianfeng Gao, Xia Song |
| 2023 | ACL | Structure-Aware Language Model Pretraining Improves Dense Retrieval on Structured Data. | Xinze Li, Zhenghao Liu, Chenyan Xiong, Shi Yu, Yu Gu, Zhiyuan Liu, Ge Yu |
| 2023 | ACL | Augmentation-Adapted Retriever Improves Generalization of Language Models as Generic Plug-In. | Zichun Yu, Chenyan Xiong, Shi Yu, Zhiyuan Liu |
| 2023 | CIKM | Text Matching Improves Sequential Recommendation by Reducing Popularity Biases. | Zhenghao Liu, Sen Mei, Chenyan Xiong, Xiaohua Li, Shi Yu, Zhiyuan Liu, Yu Gu, Ge Yu |
| 2023 | EMNLP | Augmenting Zero-Shot Dense Retrievers with Plug-in Mixture-of-Memories. | Suyu Ge, Chenyan Xiong, Corby Rosset, Arnold Overwijk, Jiawei Han, Paul Bennett |
| 2023 | EMNLP | CompleQA: Benchmarking the Impacts of Knowledge Graph Completion Methods on Question Answering. | Donghan Yu, Yu Gu, Chenyan Xiong, Yiming Yang |
| 2023 | ICLR | Universal Vision-Language Dense Retrieval: Learning A Unified Representation Space for Multi-Modal Retrieval. | Zhenghao Liu, Chenyan Xiong, Yuanhuiyi Lv, Zhiyuan Liu, Ge Yu |
| 2023 | SIGIR | Unsupervised Dense Retrieval Training with Web Anchors. | Yiqing Xie, Xiao Liu, Chenyan Xiong |
| 2023 | SIGIR | OpenMatch-v2: An All-in-one Multi-Modality PLM-based Information Retrieval Toolkit. | Shi Yu, Zhenghao Liu, Chenyan Xiong, Zhiyuan Liu |
| 2022 | ACL | Zero-Shot Dense Retrieval with Momentum Adversarial Domain Invariant Representations. | Ji Xin, Chenyan Xiong, Ashwin Srinivasan, Ankita Sharma, Damien Jose, Paul Bennett |
| 2022 | EMNLP | Dimension Reduction for Efficient Dense Retrieval via Conditional Autoencoder. | Zhenghao Liu, Han Zhang, Chenyan Xiong, Zhiyuan Liu, Yu Gu, Xiaohua Li |
| 2022 | EMNLP | Reduce Catastrophic Forgetting of Dense Retrieval Training with Teleportation Negatives. | Si Sun, Chenyan Xiong, Yue Yu, Arnold Overwijk, Zhiyuan Liu, Jie Bao |
| 2022 | EMNLP | COCO-DR: Combating the Distribution Shift in Zero-Shot Dense Retrieval with Contrastive and Distributionally Robust Learning. | Yue Yu, Chenyan Xiong, Si Sun, Chao Zhang, Arnold Overwijk |
| 2022 | ICLR | Pretraining Text Encoders with Adversarial Mixture of Training Signal Generators. | Yu Meng, Chenyan Xiong, Payal Bajaj, Saurabh Tiwary, Paul N. Bennett, Jiawei Han, Xia Song |
| 2022 | SIGIR | P3 Ranker: Mitigating the Gaps between Pre-training and Ranking Fine-tuning with Prompt-based Learning and Pre-finetuning. | Xiaomeng Hu, Shi Yu, Chenyan Xiong, Zhenghao Liu, Zhiyuan Liu, Ge Yu |
| 2022 | SIGIR | ClueWeb22: 10 Billion Web Documents with Rich Information. | Arnold Overwijk, Chenyan Xiong, Jamie Callan |
| 2021 | AAAI | Data Augmentation for Abstractive Query-Focused Multi-Document Summarization. | Ramakanth Pasunuru, Asli Celikyilmaz, Michel Galley, Chenyan Xiong, Yizhe Zhang, Mohit Bansal, Jianfeng Gao |
| 2021 | ACL | Few-Shot Text Ranking with Meta Adapted Synthetic Weak Supervision. | Si Sun, Yingzhuo Qian, Zhenghao Liu, Chenyan Xiong, Kaitao Zhang, Jie Bao, Zhiyuan Liu, Paul Bennett |
| 2021 | CIKM | Improving Query Representations for Dense Retrieval with Pseudo Relevance Feedback. | HongChien Yu, Chenyan Xiong, Jamie Callan |
| 2021 | EACL | Contrastive Multi-document Question Generation. | Woon Sang Cho, Yizhe Zhang, Sudha Rao, Asli Celikyilmaz, Chenyan Xiong, Jianfeng Gao, Mengdi Wang, Bill Dolan |
| 2021 | EMNLP | Less is More: Pretrain a Strong Siamese Encoder for Dense Text Retrieval Using a Weak Decoder. | Shuqi Lu, Di He, Chenyan Xiong, Guolin Ke, Waleed Malik, Zhicheng Dou, Paul Bennett, Tie-Yan Liu, Arnold Overwijk |
| 2021 | EMNLP | TIAGE: A Benchmark for Topic-Shift Aware Dialog Modeling. | Huiyuan Xie, Zhenghao Liu, Chenyan Xiong, Zhiyuan Liu, Ann A. Copestake |
| 2021 | EMNLP | Distantly-Supervised Dense Retrieval Enables Open-Domain Question Answering without Evidence Annotation. | Chen Zhao, Chenyan Xiong, Jordan L. Boyd-Graber, Hal Daum III |
| 2021 | ICLR | Approximate Nearest Neighbor Negative Contrastive Learning for Dense Text Retrieval. | Lee Xiong, Chenyan Xiong, Ye Li, Kwok-Fung Tang, Jialin Liu, Paul N. Bennett, Junaid Ahmed, Arnold Overwijk |
| 2021 | ICTIR | More Robust Dense Retrieval with Contrastive Dual Learning. | Yizhi Li, Zhenghao Liu, Chenyan Xiong, Zhiyuan Liu |
| 2021 | KDD | Domain-Specific Pretraining for Vertical Search: Case Study on Biomedical Literature. | Yu Wang, Jinchao Li, Tristan Naumann, Chenyan Xiong, Hao Cheng, Robert Tinn, Cliff Wong, Naoto Usuyama, Richard Rogahn, Zhihong Shen, Yang Qin, Eric Horvitz, Paul N. Bennett, Jianfeng Gao, Hoifung Poon |
| 2021 | NAACL | Multi-Step Reasoning Over Unstructured Text with Beam Dense Retrieval. | Chen Zhao, Chenyan Xiong, Jordan L. Boyd-Graber, Hal Daum III |
| 2021 | SIGIR | OpenMatch: An Open Source Library for Neu-IR Research. | Zhenghao Liu, Kaitao Zhang, Chenyan Xiong, Zhiyuan Liu, Maosong Sun |
| 2021 | SIGIR | Few-Shot Conversational Dense Retrieval. | Shi Yu, Zhenghao Liu, Chenyan Xiong, Tao Feng, Zhiyuan Liu |
| 2020 | AAAI | Latent Relation Language Models. | Hiroaki Hayashi, Zecong Hu, Chenyan Xiong, Graham Neubig |
| 2020 | ACL | Fine-grained Fact Verification with Kernel Graph Attention Network. | Zhenghao Liu, Chenyan Xiong, Maosong Sun, Zhiyuan Liu |
| 2020 | ACL | Grounded Conversation Generation as Guided Traverses in Commonsense Knowledge Graphs. | Houyu Zhang, Zhenghao Liu, Chenyan Xiong, Zhiyuan Liu |
| 2020 | EMNLP | Long Document Ranking with Query-Directed Sparse Transformer. | Jyun-Yu Jiang, Chenyan Xiong, Chia-Jung Lee, Wei Wang |
| 2020 | EMNLP | Generalizing Open Domain Fact Extraction and Verification to COVID-FACT thorough In-Domain Language Modeling. | Zhenghao Liu, Chenyan Xiong, Zhuyun Dai, Si Sun, Maosong Sun, Zhiyuan Liu |
| 2020 | EMNLP | Text Classification Using Label Names Only: A Language Model Self-Training Approach. | Yu Meng, Yunyi Zhang, Jiaxin Huang, Chenyan Xiong, Heng Ji, Chao Zhang, Jiawei Han |
| 2020 | ICLR | Transformer-XH: Multi-Evidence Reasoning with eXtra Hop Attention. | Chen Zhao, Chenyan Xiong, Corby Rosset, Xia Song, Paul N. Bennett, Saurabh Tiwary |
| 2020 | WWW | Leading Conversational Search by Suggesting Useful Questions. | Corbin Rosset, Chenyan Xiong, Xia Song, Daniel Campos, Nick Craswell, Saurabh Tiwary, Paul N. Bennett |
| 2020 | WWW | TaxoExpan: Self-supervised Taxonomy Expansion with Position-Enhanced Graph Neural Network. | Jiaming Shen, Zhihong Shen, Chenyan Xiong, Chi Wang, Kuansan Wang, Jiawei Han |
| 2020 | WWW | Selective Weak Supervision for Neural Information Retrieval. | Kaitao Zhang, Chenyan Xiong, Zhenghao Liu, Zhiyuan Liu |
| 2020 | WWW | Complex Factoid Question Answering with a Free-Text Knowledge Graph. | Chen Zhao, Chenyan Xiong, Xin Qian, Jordan L. Boyd-Graber |
| 2020 | SIGIR | CAsT-19: A Dataset for Conversational Information Seeking. | Jeffrey Dalton, Chenyan Xiong, Vaibhav Kumar, Jamie Callan |
| 2020 | SIGIR | Recent Advances in Conversational Information Retrieval. | Jianfeng Gao, Chenyan Xiong, Paul Bennett |
| 2020 | SIGIR | Knowledge Enhanced Personalized Search. | Shuqi Lu, Zhicheng Dou, Chenyan Xiong, Xiaojie Wang, Ji-Rong Wen |
| 2020 | SIGIR | Contextual Re-Ranking with Behavior Aware Transformers. | Chen Qu, Chenyan Xiong, Yizhe Zhang, Corby Rosset, W. Bruce Croft, Paul N. Bennett |
| 2020 | SIGIR | Few-Shot Generative Conversational Query Rewriting. | Shi Yu, Jiahua Liu, Jingqin Yang, Chenyan Xiong, Paul N. Bennett, Jianfeng Gao, Zhiyuan Liu |
| 2019 | ACL | Target-Guided Open-Domain Conversation. | Jianheng Tang, Tiancheng Zhao, Chenyan Xiong, Xiaodan Liang, Eric P. Xing, Zhiting Hu |
| 2019 | EMNLP | Open Domain Web Keyphrase Extraction Beyond Language Modeling. | Lee Xiong, Chuan Hu, Chenyan Xiong, Daniel Campos, Arnold Overwijk |
| 2019 | ICTIR | Neural Document Expansion with User Feedback. | Yue Yin, Chenyan Xiong, Cheng Luo, Zhiyuan Liu |
| 2019 | SIGIR | An Axiomatic Approach to Regularizing Neural Ranking Models. | Corby Rosset, Bhaskar Mitra, Chenyan Xiong, Nick Craswell, Xia Song, Saurabh Tiwary |
| 2019 | SIGIR | Generic Intent Representation in Web Search. | Hongfei Zhang, Xia Song, Chenyan Xiong, Corby Rosset, Paul N. Bennett, Nick Craswell, Saurabh Tiwary |
| 2018 | ACL | Entity-Duet Neural Ranking: Understanding the Role of Knowledge Graph Semantics in Neural Information Retrieval. | Zhenghao Liu, Chenyan Xiong, Maosong Sun, Zhiyuan Liu |
| 2018 | EMNLP | Automatic Event Salience Identification. | Zhengzhong Liu, Chenyan Xiong, Teruko Mitamura, Eduard H. Hovy |
| 2018 | WWW | Query Suggestion with Feedback Memory Network. | Bin Wu, Chenyan Xiong, Maosong Sun, Zhiyuan Liu |
| 2018 | SIGIR | The Second Workshop on Knowledge Graphs and Semantics for Text Retrieval, Analysis, and Understanding (KG4IR). | Laura Dietz, Chenyan Xiong, Jeff Dalton, Edgar Meij |
| 2018 | SIGIR | Consistency and Variation in Kernel Neural Ranking Model. | Mary Arpita Pyreddy, Varshini Ramaseshan, Narendra Nath Joshi, Zhuyun Dai, Chenyan Xiong, Jamie Callan, Zhiyuan Liu |
| 2018 | SIGIR | Towards Better Text Understanding and Retrieval through Kernel Entity Salience Modeling. | Chenyan Xiong, Zhengzhong Liu, Jamie Callan, Tie-Yan Liu |
| 2018 | WSDM | Convolutional Neural Networks for Soft-Matching N-Grams in Ad-hoc Search. | Zhuyun Dai, Chenyan Xiong, Jamie Callan, Zhiyuan Liu |
| 2017 | CIKM | JointSem: Combining Query Entity Linking and Entity based Document Ranking. | Chenyan Xiong, Zhengzhong Liu, Jamie Callan, Eduard H. Hovy |
| 2017 | WWW | Explicit Semantic Ranking for Academic Search via Knowledge Graph Embedding. | Chenyan Xiong, Russell Power, Jamie Callan |
| 2017 | SIGIR | The First Workshop on Knowledge Graphs and Semantics for Text Retrieval and Analysis (KG4IR). | Laura Dietz, Chenyan Xiong, Edgar Meij |
| 2017 | SIGIR | DBpedia-Entity v2: A Test Collection for Entity Search. | Faegheh Hasibi, Fedor Nikolaev, Chenyan Xiong, Krisztian Balog, Svein Erik Bratsberg, Alexander Kotov, Jamie Callan |
| 2017 | SIGIR | Natural Language Supported Relation Matching for Question Answering with Knowledge Graphs. | Hongyu Li, Chenyan Xiong, Jamie Callan |
| 2017 | SIGIR | Word-Entity Duet Representations for Document Ranking. | Chenyan Xiong, Jamie Callan, Tie-Yan Liu |
| 2017 | SIGIR | End-to-End Neural Ad-hoc Ranking with Kernel Pooling. | Chenyan Xiong, Zhuyun Dai, Jamie Callan, Zhiyuan Liu, Russell Power |
| 2016 | CIKM | Query-Biased Partitioning for Selective Search. | Zhuyun Dai, Chenyan Xiong, Jamie Callan |
| 2016 | ICTIR | Bag-of-Entities Representation for Ranking. | Chenyan Xiong, Jamie Callan, Tie-Yan Liu |
| 2016 | SIGIR | An Empirical Study of Learning to Rank for Entity Search. | Jing Chen, Chenyan Xiong, Jamie Callan |
| 2015 | CIKM | EsdRank: Connecting Query and Documents through External Semi-Structured Data. | Chenyan Xiong, Jamie Callan |
| 2015 | ICTIR | Query Expansion with Freebase. | Chenyan Xiong, Jamie Callan |
| 2014 | SIGIR | A language modeling approach to entity recognition and disambiguation for search queries. | Bhavana Bharat Dalvi, Chenyan Xiong, Jamie Callan |
| 2013 | EMNLP | Automatic Domain Partitioning for Multi-Domain Learning. | Di Wang, Chenyan Xiong, William Yang Wang |
| 2012 | WSDM | Relational click prediction for sponsored search. | Chenyan Xiong, Taifeng Wang, Wenkui Ding, Yidong Shen, Tie-Yan Liu |