| 2024 | Can LLMs Master Math? Investigating Large Language Models on Math Stack Exchange. | Ankit Satpute, Noah Gieing, Andr Greiner-Petter, Moritz Schubotz, Olaf Teschke, Akiko Aizawa, Bela Gipp |
| 2024 | Leveraging LLMs for Detecting and Modeling the Propagation of Misinformation in Social Networks. | Payel Santra |
| 2024 | Synthetic Query Generation using Large Language Models for Virtual Assistants. | Sonal Sannigrahi, Thiago Fraga-Silva, Youssef Oualil, Christophe Van Gysel |
| 2024 | ProCIS: A Benchmark for Proactive Retrieval in Conversations. | Chris Samarinas, Hamed Zamani |
| 2024 | Evaluating Retrieval Quality in Retrieval-Augmented Generation. | Alireza Salemi, Hamed Zamani |
| 2024 | Towards a Search Engine for Machines: Unified Ranking for Multiple Retrieval-Augmented Large Language Models. | Alireza Salemi, Hamed Zamani |
| 2024 | Optimization Methods for Personalizing Large Language Models through Retrieval Augmentation. | Alireza Salemi, Surya Kallumadi, Hamed Zamani |
| 2024 | Monitoring the Evolution of Behavioural Embeddings in Social Media Recommendation. | Srijan Saket, Olivier Jeunen, Md. Danish Kalim |
| 2024 | Beyond Accuracy: Investigating Error Types in GPT-4 Responses to USMLE Questions. | Soumyadeep Roy, Aparup Khatua, Fatemeh Ghoochani, Uwe Hadler, Wolfgang Nejdl, Niloy Ganguly |
| 2024 | TextData: Save What You Know and Find What You Don't. | Kevin Ros, Kedar Takwane, Ashwin Patil, Rakshana Jayaprakash, ChengXiang Zhai |
| 2024 | "Ask Me Anything": How Comcast Uses LLMs to Assist Agents in Real Time. | Scott Rome, Tianwen Chen, Raphael Tang, Luwei Zhou, Ferhan Ture |
| 2024 | Mosaicing Prevention in Declassification. | Nathaniel W. Rollings |
| 2024 | Explainable Uncertainty Attribution for Sequential Recommendation. | Carles Balsells Rodas, Fan Yang, Zhishen Huang, Yan Gao |
| 2024 | Machine Generated Explanations and Their Evaluation. | Edward Richards |
| 2024 | Enhancing Sequential Recommenders with Augmented Knowledge from Aligned Large Language Models. | Yankun Ren, Zhongde Chen, Xinxing Yang, Longfei Li, Cong Jiang, Lei Cheng, Bo Zhang, Linjian Mo, Jun Zhou |
| 2024 | Can We Trust Recommender System Fairness Evaluation? The Role of Fairness and Relevance. | Theresia Veronika Rampisela, Tuukka Ruotsalo, Maria Maistro, Christina Lioma |
| 2024 | Towards Ethical Item Ranking: A Paradigm Shift from User-Centric to Item-Centric Approaches. | Guilherme Ramos, Mirko Marras, Ludovico Boratto |
| 2024 | Negative Sampling Techniques for Dense Passage Retrieval in a Multilingual Setting. | Thilina Chaturanga Rajapakse, Andrew Yates, Maarten de Rijke |
| 2024 | Graph-Based Audience Expansion Model for Marketing Campaigns. | Md. Mostafizur Rahman, Daisuke Kikuta, Yu Hirate, Toyotaro Suzumura |
| 2024 | LLM4Eval: Large Language Model for Evaluation in IR. | Hossein A. Rahmani, Clemencia Siro, Mohammad Aliannejadi, Nick Craswell, Charles L. A. Clarke, Guglielmo Faggioli, Bhaskar Mitra, Paul Thomas, Emine Yilmaz |
| 2024 | Synthetic Test Collections for Retrieval Evaluation. | Hossein A. Rahmani, Nick Craswell, Emine Yilmaz, Bhaskar Mitra, Daniel Campos |
| 2024 | Explicitly Integrating Judgment Prediction with Legal Document Retrieval: A Law-Guided Generative Approach. | Weicong Qin, Zelin Cao, Weijie Yu, Zihua Si, Sirui Chen, Jun Xu |
| 2024 | Shadowfax: Harnessing Textual Knowledge Base Population. | Maxime Prieur, Cdric du Mouza, Guillaume Gadek, Bruno Grilhres |
| 2024 | ChroniclingAmericaQA: A Large-scale Question Answering Dataset based on Historical American Newspaper Pages. | Bhawna Piryani, Jamshid Mozafari, Adam Jatowt |
| 2024 | IR-RAG @ SIGIR24: Information Retrieval's Role in RAG Systems. | Fabio Petroni, Federico Siciliano, Fabrizio Silvestri, Giovanni Trappolini |