Shitao Xiao
Publication record assembled from the DBLP archive of ranked conferences.
Papers indexed
34
Venues
12
Active years
2021–2026
Best venue rank
A*
Where they publish
Papers
34 indexed papers, newest first.
| Year | Venue | Title | Authors |
|---|---|---|---|
| 2026 | AAAI | RetroLM: Retrieval-Augmented KVs for Long-Context Processing. | Kun Luo, Zheng Liu, Shitao Xiao, Jiabei Chen, Hongjin Qian, Peitian Zhang, Shanshan Jiang, Bin Dong, Jun Zhao, Kang Liu |
| 2026 | ACL | Reinforcing Agentic Search Via Reward Density Optimization. | Kun Luo, Hongjin Qian, Zheng Liu, Ziyi Xia, Shitao Xiao, Zhao Cao, Siqi Bao, Jun Zhao, Kang Liu |
| 2026 | ACL | EfficientLLM: Unified Pruning-Aware Pretraining for Auto-Designed Compact Language Models. | Xingrun Xing, Zheng Liu, Shitao Xiao, Boyan Gao, Yiming Liang, Haokun Lin, Xianlin Zeng, Guoqi Li, Jiajun Zhang |
| 2025 | ACL | MegaPairs: Massive Data Synthesis for Universal Multimodal Retrieval. | Junjie Zhou, Yongping Xiong, Zheng Liu, Ze Liu, Shitao Xiao, Yueze Wang, Bo Zhao, Chen Jason Zhang, Defu Lian |
| 2025 | ACL | AIR-Bench: Automated Heterogeneous Information Retrieval Benchmark. | Jianlyu Chen, Nan Wang, Chaofan Li, Bo Wang, Shitao Xiao, Han Xiao, Hao Liao, Defu Lian, Zheng Liu |
| 2025 | ACL | Any Information Is Just Worth One Single Screenshot: Unifying Search With Visualized Information Retrieval. | Zheng Liu, Ze Liu, Zhengyang Liang, Junjie Zhou, Shitao Xiao, Chao Gao, Chen Jason Zhang, Defu Lian |
| 2025 | COLING | FineRAG: Fine-grained Retrieval-Augmented Text-to-Image Generation. | Huaying Yuan, Ziliang Zhao, Shuting Wang, Shitao Xiao, Minheng Ni, Zheng Liu, Zhicheng Dou |
| 2025 | CVPR | MLVU: Benchmarking Multi-task Long Video Understanding. | Junjie Zhou, Yan Shu, Bo Zhao, Boya Wu, Zhengyang Liang, Shitao Xiao, Minghao Qin, Xi Yang, Yongping Xiong, Bo Zhang, Tiejun Huang, Zheng Liu |
| 2025 | CVPR | OmniGen: Unified Image Generation. | Shitao Xiao, Yueze Wang, Junjie Zhou, Huaying Yuan, Xingrun Xing, Ruiran Yan, Chaofan Li, Shuting Wang, Tiejun Huang, Zheng Liu |
| 2025 | ICLR | Making Text Embedders Few-Shot Learners. | Chaofan Li, Minghao Qin, Shitao Xiao, Jianlyu Chen, Kun Luo, Defu Lian, Yingxia Shao, Zheng Liu |
| 2025 | ICLR | SpikeLLM: Scaling up Spiking Neural Network to Large Language Models via Saliency-based Spiking. | Xingrun Xing, Boyan Gao, Zheng Liu, David A. Clifton, Shitao Xiao, Wanpeng Zhang, Li Du, Zheng Zhang, Guoqi Li, Jiajun Zhang |
| 2025 | ICLR | Long Context Compression with Activation Beacon. | Peitian Zhang, Zheng Liu, Shitao Xiao, Ninglu Shao, Qiwei Ye, Zhicheng Dou |
| 2025 | WWW | Fitting Into Any Shape: A Flexible LLM-Based Re-Ranker With Configurable Depth and Width. | Zheng Liu, Chaofan Li, Shitao Xiao, Chaozhuo Li, Chen Jason Zhang, Hao Liao, Defu Lian, Yingxia Shao |
| 2025 | WSDM | Lighter And Better: Towards Flexible Context Adaptation For Retrieval Augmented Generation. | Chenyuan Wu, Ninglu Shao, Zheng Liu, Shitao Xiao, Chaozhuo Li, Chen Zhang, Senzhang Wang, Defu Lian |
| 2024 | ACL | M3-Embedding: Multi-Linguality, Multi-Functionality, Multi-Granularity Text Embeddings Through Self-Knowledge Distillation. | Jianlyu Chen, Shitao Xiao, Peitian Zhang, Kun Luo, Defu Lian, Zheng Liu |
| 2024 | ACL | Llama2Vec: Unsupervised Adaptation of Large Language Models for Dense Retrieval. | Chaofan Li, Zheng Liu, Shitao Xiao, Yingxia Shao, Defu Lian |
| 2024 | ACL | Landmark Embedding: A Chunking-Free Embedding Method For Retrieval Augmented Long-Context Large Language Models. | Kun Luo, Zheng Liu, Shitao Xiao, Tong Zhou, Yubo Chen, Jun Zhao, Kang Liu |
| 2024 | ACL | LM-Cocktail: Resilient Tuning of Language Models via Model Merging. | Shitao Xiao, Zheng Liu, Peitian Zhang, Xingrun Xing |
| 2024 | ACL | A Multi-Task Embedder For Retrieval Augmented LLMs. | Peitian Zhang, Zheng Liu, Shitao Xiao, Zhicheng Dou, Jian-Yun Nie |
| 2024 | ACL | VISTA: Visualized Text Embedding For Universal Multi-Modal Retrieval. | Junjie Zhou, Zheng Liu, Shitao Xiao, Bo Zhao, Yongping Xiong |
| 2024 | EMNLP | Large Language Models as Foundations for Next-Gen Dense Retrieval: A Comprehensive Empirical Assessment. | Kun Luo, Minghao Qin, Zheng Liu, Shitao Xiao, Jun Zhao, Kang Liu |
| 2024 | ICML | SpikeLM: Towards General Spike-Driven Language Modeling via Elastic Bi-Spiking Mechanisms. | Xingrun Xing, Zheng Zhang, Ziyi Ni, Shitao Xiao, Yiming Ju, Siqi Fan, Yequan Wang, Jiajun Zhang, Guoqi Li |
| 2024 | SIGIR | C-Pack: Packed Resources For General Chinese Embeddings. | Shitao Xiao, Zheng Liu, Peitian Zhang, Niklas Muennighoff, Defu Lian, Jian-Yun Nie |
| 2023 | ACL | RetroMAE-2: Duplex Masked Auto-Encoder For Pre-Training Retrieval-Oriented Language Models. | Zheng Liu, Shitao Xiao, Yingxia Shao, Zhao Cao |
| 2023 | CIKM | Diversity-aware Deep Ranking Network for Recommendation. | Zihong Wang, Yingxia Shao, Jiyuan He, Jinbao Liu, Shitao Xiao, Tao Feng, Ming Liu |
| 2023 | EMNLP | Hybrid Inverted Index Is a Robust Accelerator for Dense Retrieval. | Peitian Zhang, Zheng Liu, Shitao Xiao, Zhicheng Dou, Jing Yao |
| 2023 | SIGIR | LibVQ: A Toolkit for Optimizing Vector Quantization and Efficient Neural Retrieval. | Chaofan Li, Zheng Liu, Shitao Xiao, Yingxia Shao, Defu Lian, Zhao Cao |
| 2022 | EMNLP | RetroMAE: Pre-Training Retrieval-oriented Language Models Via Masked Auto-Encoder. | Shitao Xiao, Zheng Liu, Yingxia Shao, Zhao Cao |
| 2022 | KDD | Training Large-Scale News Recommenders with Pretrained Language Models in the Loop. | Shitao Xiao, Zheng Liu, Yingxia Shao, Tao Di, Bhuvan Middha, Fangzhao Wu, Xing Xie |
| 2022 | KDD | Uni-Retriever: Towards Learning the Unified Embedding Based Retriever in Bing Sponsored Search. | Jianjin Zhang, Zheng Liu, Weihao Han, Shitao Xiao, Ruicheng Zheng, Yingxia Shao, Hao Sun, Hanqing Zhu, Premkumar Srinivasan, Weiwei Deng, Qi Zhang, Xing Xie |
| 2022 | WWW | MINDSim: User Simulator for News Recommenders. | Xufang Luo, Zheng Liu, Shitao Xiao, Xing Xie, Dongsheng Li |
| 2022 | WWW | Progressively Optimized Bi-Granular Document Representation for Scalable Embedding Based Retrieval. | Shitao Xiao, Zheng Liu, Weihao Han, Jianjin Zhang, Yingxia Shao, Defu Lian, Chaozhuo Li, Hao Sun, Denvy Deng, Liangjie Zhang, Qi Zhang, Xing Xie |
| 2022 | SIGIR | Distill-VQ: Learning Retrieval Oriented Vector Quantization By Distilling Knowledge from Dense Embeddings. | Shitao Xiao, Zheng Liu, Weihao Han, Jianjin Zhang, Defu Lian, Yeyun Gong, Qi Chen, Fan Yang, Hao Sun, Yingxia Shao, Xing Xie |
| 2021 | EMNLP | Matching-oriented Embedding Quantization For Ad-hoc Retrieval. | Shitao Xiao, Zheng Liu, Yingxia Shao, Defu Lian, Xing Xie |