| 2026 | ArtistMus: A Globally Diverse, Artist-Centric Benchmark for Retrieval-Augmented Music Question Answering. | Daeyong Kwon, Seungheon Doh, Juhan Nam |
| 2026 | National Library as Corpus: DeLiKo-2025@DNB - a Very Large Corpus of German-language Contemporary Literature. | Marc Kupietz, Nils Diewald, Philippe Gent, Andreas Witt |
| 2026 | A Dataset for Probing Translationese Preferences in English-to-Swedish Translation. | Jenny Kunz, Anja Jarochenko, Marcel Bollmann |
| 2026 | A Diagnostic Benchmark for Sweden-Related Factual Knowledge. | Jenny Kunz |
| 2026 | EPIC-EuroParl-UdS: Information-Theoretic Perspectives on Translation and Interpreting. | Maria Kunilovskaya, Christina Pollklsener |
| 2026 | Building a One-Million-Pair Bokml-Nynorsk Translation Corpus: A Quality-First Harvesting and Cleaning Pipeline. | Per Egil Kummervold, Thea Tollersrud, Angelina Zanardi |
| 2026 | Sentence-Level Back-Transliteration of Romanized Indian Languages: Performance Analysis and Challenges. | Saurabh Kumar, Dhruvkumar Babubhai Kakadiya, Sanasam Ranbir Singh, Sukumar Nandi |
| 2026 | Singlish to English Translation with Precision: A Dataset and Language Detection-Driven Masked Modeling for Singlish to English Translation. | Sujit Kumar, Gerome Kusuma Ang, Stephanie Hilary Xinyi Ma, Andy Hau Yan Ho, Andy W. H. Khong |
| 2026 | When Structure Matters: Cross-Lingual Hyperbolic Embeddings for Chinese and English Wordnets. | Mao-Chang Ku, Da-Chen Lian, Pin-Er Chen, Po-Ya Angela Wang, Wei-Ling Chen, Shu-Kai Hsieh |
| 2026 | CorEGe-PT: Compiling a Large Corpus of Academic Texts in Portuguese. | Tanara Zingano Kuhn, Jos Matos, Bruno Neves, Daniela Pereira, Elisabete Cao, Ivo Simes, Jacinto Estima, Delfim Leo, Hugo Gonalo Oliveira |
| 2026 | VectorEdits: A Dataset and Benchmark for Instruction-Based Editing of Vector Graphics. | Josef Kuchar, Marek Kadlck, Michal Spiegel, Michal Stefnik |
| 2026 | Generating High Quality Synthetic Data for Dutch Medical Conversations. | Cecilia Kuan, Aditya Kamlesh Parikh, Henk van den Heuvel |
| 2026 | Comparing Traditional and LLM-based Approaches for Automated Scoring of Dutch Writing Products. | Joni Kruijsbergen, Orphee De Clercq |
| 2026 | A Test Collection for Part-of-Speech Tagging and Word Sense Disambiguation. | Robert Krovetz |
| 2026 | TkTk: Syntactic Analysis of Language Use on Danish TikTok. | Thea Kristensen, Rob van der Goot |
| 2026 | Evaluating Large Language Models for Text-to-Gloss Translation in Kazakh-Russian Sign Language: A Pilot Study. | Zhanibek Kozhirbayev, Alfarabi Imashev |
| 2026 | Same Meaning, Different Scores: Lexical and Syntactic Sensitivity in LLM Evaluation. | Bogdan Kostic, Conor Fallon, Julian Risch, Alexander Lser |
| 2026 | ParliaBench: An Evaluation and Benchmarking Framework for LLM-Generated Parliamentary Speech. | Marios Koniaris, Argyro Tsipi, Panayiotis Tsanakas |
| 2026 | Bulgarian Massive Multitask Language Understanding Benchmark. | Svetla Peneva Koeva, Ivelina Stoyanova, Dimiter Georgiev, Svetlozara Leseva, Valentina Stefanova, Maria Todorova, Tsvetana Ivanova Dimitrova, Hristina Kukova, Mihaela Moskova, Tinko Tinchev |
| 2026 | Injecting Structured Biomedical Knowledge into Language Models: Continual Pretraining vs. GraphRAG. | Jaafer Klila, Sondes Bannour Souihi, Rahma Boujelbane, Nasredine Semmar, Lamia Hadrich Belguith |
| 2026 | How Much Data Is Enough Data? A New Motion Capture Corpus for Probabilistic Sign Language Generation. | Anna Klezovich, Johanna Mesch, Gustav Eje Henter, Jonas Beskow |
| 2026 | A Dataset for Evaluating ASR on Specialized Vocabulary. | Emily Haubert Klering, Eduardo Gabriel Cortes, Tatjana Chernenko, Mariana Vargas Trarbach, Gabriel de Oliveira Ramos, Sandro Jos Rigo, Mait Dupont, Ana Luiza Treichel Vianna, Gabriela Krause dos Santos, Vinicius Meirelles Pereira, Denis Andrei de Arajo, Rafael Kunst |
| 2026 | Evaluation of Failure Communication Strategies for Trust Repair in Human-AI Collaboration. | Stina Klein, Alexandru Wurm, Elisabeth Andr, Matthias Kraus |
| 2026 | Towards Clinical Applications of NLP: Detecting Emotion Regulation via Emotional Categories and Expression Modes in French Transcriptions. | Salome Klein, Amalia Todirascu, Hlne Vassiliadou |
| 2026 | Vrittanta-AS: Dataset Development and Benchmarking for Event Trigger Detection and Classification in Assamese. | Chaitanya Kirti, Dhrubajyoti Pathak, Ashish Anand, Prithwijit Guha |