| 2026 | ECIR | Contrastive Learning Falls Short: Improving Dense Retrieval with Cross-Encoder Listwise Distillation and Synthetic Data. | Manveer Singh Tamber, Suleman Kazi, Vivek Sourabh, Jimmy Lin |
| 2025 | ECIR | LiT and Lean: Distilling Listwise Rerankers Into Encoder-Decoder Models. | Manveer Singh Tamber, Ronak Pradeep, Jimmy Lin |
| 2025 | EMNLP | Benchmarking LLM Faithfulness in RAG with Evolving Leaderboards. | Manveer Singh Tamber, Forrest Sheng Bao, Chenyu Xu, Ge Luo, Suleman Kazi, Minseok Bae, Miaoran Li, Ofer Mendelevitch, Renyi Qu, Jimmy Lin |
| 2025 | IJCNLP | Illusions of Relevance: Arbitrary Content Injection Attacks Deceive Retrievers, Rerankers, and LLM Judges. | Manveer Singh Tamber, Jimmy Lin |
| 2025 | NAACL | FaithBench: A Diverse Hallucination Benchmark for Summarization by Modern LLMs. | Forrest Sheng Bao, Miaoran Li, Renyi Qu, Ge Luo, Erana Wan, Yujia Tang, Weisi Fan, Manveer Singh Tamber, Suleman Kazi, Vivek Sourabh, Mike Qi, Ruixuan Tu, Chenyu Xu, Matthew Gonzales, Ofer Mendelevitch, Amin Ahmad |
| 2025 | NAACL | Can't Hide Behind the API: Stealing Black-Box Commercial Embedding Models. | Manveer Singh Tamber, Jasper Xian, Jimmy Lin |
| 2023 | ECIR | PyGaggle: A Gaggle of Resources for Open-Domain Question Answering. | Ronak Pradeep, Haonan Chen, Lingwei Gu, Manveer Singh Tamber, Jimmy Lin |
| 2023 | ECIR | Pre-processing Matters! Improved Wikipedia Corpora for Open-Domain Question Answering. | Manveer Singh Tamber, Ronak Pradeep, Jimmy Lin |