| 2026 | ECIR | Workshop on Conversational Search for Complex Information Needs. | Roxana Petcu, Mert Yazan, Mohanna Hoveyda, Jirui Qi, Maarten de Rijke |
| 2026 | ECIR | How Role-Play Shapes Relevance Judgment in Zero-Shot LLM Rankers. | Yumeng Wang, Jirui Qi, Catherine Chen, Panagiotis Eustratiadis, Suzan Verberne |
| 2025 | EMNLP | When Models Reason in Your Language: Controlling Thinking Language Comes at the Cost of Accuracy. | Jirui Qi, Shan Chen, Zidi Xiong, Raquel Fernndez, Danielle S. Bitterman, Arianna Bisazza |
| 2025 | NAACL | Pointwise Mutual Information as a Performance Gauge for Retrieval-Augmented Generation. | Tianyu Liu, Jirui Qi, Paul He, Arianna Bisazza, Mrinmaya Sachan, Ryan Cotterell |
| 2024 | EMNLP | The SIFo Benchmark: Investigating the Sequential Instruction Following Ability of Large Language Models. | Xinyi Chen, Baohao Liao, Jirui Qi, Panagiotis Eustratiadis, Christof Monz, Arianna Bisazza, Maarten de Rijke |
| 2024 | EMNLP | Model Internals-based Answer Attribution for Trustworthy Retrieval-Augmented Generation. | Jirui Qi, Gabriele Sarti, Raquel Fernndez, Arianna Bisazza |
| 2023 | AAAI | Multi-Mask Label Mapping for Prompt-Based Learning. | Jirui Qi, Richong Zhang, Jaein Kim, Junfan Chen, Wenyi Qin, Yongyi Mao |
| 2023 | EMNLP | Cross-Lingual Consistency of Factual Knowledge in Multilingual Language Models. | Jirui Qi, Raquel Fernndez, Arianna Bisazza |
| 2022 | EMNLP | Parameter-free Automatically Prompting: A Latent Pseudo Label Mapping Model for Prompt-based Learning. | Jirui Qi, Richong Zhang, Junfan Chen, Jaein Kim, Yongyi Mao |