| 2025 | A Learned Cost Model-based Cross-engine Optimizer for SQL Workloads. | Andrs Strausz, Niels Pardon, Ioana Giurgiu |
| 2025 | Instance-Optimized String Fingerprints. | Mihail Stoian, Johannes Thrauf, Andreas Zimmerer, Alexander van Renen, Andreas Kipf |
| 2025 | Eudoxia: a FaaS scheduling simulator for the composable lakehouse. | Tapan Srivastava, Jacopo Tagliabue, Ciro Greco |
| 2025 | EnGraph: Ensemble-Based Augmentation for Graph Anomaly Detection. | Andrew Shields, Robert Sheehy, Pat Doody |
| 2025 | MageSQL: Enhancing In-context Learning for Text-to-SQL Applications with Large Language Models. | Chen Shen, Jin Wang, Sajjadur Rahman, Eser Kandogan |
| 2025 | Enumeration-Based Dynamic Query Processing for Linear Algebra Workloads in Data Science. | Thomas Munoz Serrano |
| 2025 | Dynamic Knowledge Graph-based Measurement of Data Quality. | Johannes Schrott, Rainer Meindl, Christian Lettner, Stefan Hammer, Magdalena Leitner |
| 2025 | Graph-Enhanced Large Language Models for Spatial Search [Vision]. | Nicole Schneider, Kent O'Sullivan, Hanan Samet |
| 2025 | Lightweight Pipelines: Good Enough is Sometimes Better. | Camilla Sancricca, Cinzia Cappiello |
| 2025 | Exploring Wavelet Trees as Space-Efficient Physical-to-Sorted Mapping for Learned Indexes. | Anwesha Saha, Aneesh Raman, Ryan Marcus, Manos Athanassoulis |
| 2025 | Towards Data-Metadata Flexibility in Property Graph Data Management. | Sepehr Sadoughi |
| 2025 | Exploring Privacy-Preserving Record Linkage: A Holistic Framework for Dataset Generation and Detailed Result Analysis. | Florens Rohde, Victor Christen, Erhard Rahm |
| 2025 | Assessing the Fault Tolerance of Data-Centric Applications. | Maria Ramos |
| 2025 | Human + AI: Large scale Data Curation For Multilingual Guardrails. | Harshit Rajgarhia, Abhishek Mukherji, Fen Yik, Dominika Borek, Nicole Warren, Prithiviraj Pradeep |
| 2025 | CleanAgent: Automating Data Standardization with LLM-based Agents. | Danrui Qi, Zhengjie Miao, Jiannan Wang |
| 2025 | xpSHACL: Explainable SHACL Validation using Retrieval-Augmented Generation and Large Language Models. | Gustavo Publio, Jos Emilio Labra Gayo |
| 2025 | Reducing Human Effort in Evaluating Small and Medium Language Models as Students and as Teachers. | Oleh Prostakov, Viacheslav Hodlevskyi, Nassim Bouarour, Adam Sanchez-Ayte, Noha Ibrahim, Sihem Amer-Yahia |
| 2025 | Query Plan Generation for Table Question Answering. | Ivan A. Poddubnyi, Nikita O. Dorodnykh |
| 2025 | GranPipe: Composable Hierarchical Pipelines for Near-Data Processing. | Johannes Pietrzyk, Wolfgang Lehner, Dirk Habich, Philippe Bonnet |
| 2025 | Out in the Wild: Investigating the Impact of Imperfect Data on a Tabular Foundation Model. | Vasileios Papastergios, Anastasios Gounaris |
| 2025 | Building IBM watsonx.data from Composable Parts. | Aditi Pandit |
| 2025 | LanceDB - Embracing Composability in the Storage Layer. | Weston Pace, Chang She, Lei Xu, Will Jones, Rob Meng, Yang Cen |
| 2025 | Table Header Recognition Based on Large Language Models. | Ilia I. Okhotin, Nikita O. Dorodnykh |
| 2025 | LightUL: An Efficient Recommendation Unlearning Framework. | Wentao Ning, Haorui He, Reynold Cheng, Nur Al Hasan Haldar, Ben Kao, Nan Huo, Bo Tang, Yupeng Li |
| 2025 | Bootstrapping Learned Cost Models with Synthetic SQL Queries. | Michael Nidd, Christoph Miksovic, Thomas Gschwind, Francesco Fusco, Andrea Giovannini, Ioana Giurgiu |