| 2026 | ACL | CoQuIR: A Comprehensive Benchmark for Code Quality-Aware Information Retrieval. | Jiahui Geng, Fengyu Cai, Shaobo Cui, Qing Li, Liangwei Chen, Chenyang Lyu, Haonan Li, Derui Zhu, Alexander Pretschner, Heinz Koeppl, Fakhri Karray |
| 2025 | EMNLP | MoR: Better Handling Diverse Queries with a Mixture of Sparse, Dense, and Human Retrievers. | Jushaan Singh Kalra, Xinran Zhao, To Eun Kim, Fengyu Cai, Fernando Diaz, Tongshuang Wu |
| 2024 | ACL | GeoHard: Towards Measuring Class-wise Hardness through Modelling Class Semantics. | Fengyu Cai, Xinran Zhao, Hongming Zhang, Iryna Gurevych, Heinz Koeppl |
| 2024 | CIKM | Aligning Large Language Model with Direct Multi-Preference Optimization for Recommendation. | Zhuoxi Bai, Ning Wu, Fengyu Cai, Xinyi Zhu, Yun Xiong |
| 2024 | EMNLP | MixGR: Enhancing Retriever Generalization for Scientific Domain through Complementary Granularity. | Fengyu Cai, Xinran Zhao, Tong Chen, Sihao Chen, Hongming Zhang, Iryna Gurevych, Heinz Koeppl |
| 2024 | NAACL | A Survey of Confidence Estimation and Calibration in Large Language Models. | Jiahui Geng, Fengyu Cai, Yuxia Wang, Heinz Koeppl, Preslav Nakov, Iryna Gurevych |
| 2022 | ICASSP | Slim: Explicit Slot-Intent Mapping with Bert for Joint Multi-Intent Detection and Slot Filling. | Fengyu Cai, Wanhao Zhou, Fei Mi, Boi Faltings |
| 2021 | EMNLP | Self-training Improves Pre-training for Few-shot Learning in Task-oriented Dialog Systems. | Fei Mi, Wanhao Zhou, Lingjing Kong, Fengyu Cai, Minlie Huang, Boi Faltings |