| 2024 | Synthetic Data Generation and Joint Learning for Robust Code-Mixed Translation. | Kartik, Sanjana Soni, Anoop Kunchukuttan, Tanmoy Chakraborty, Md. Shad Akhtar |
| 2024 | Using Bibliodata LODification to Create Metadata-Enriched Literary Corpora in Line with FAIR Principles. | Agnieszka Karlinska, Cezary Rosinski, Marek Kubis, Patryk Hubar, Jan Wieczorek |
| 2024 | GlotScript: A Resource and Tool for Low Resource Writing System Identification. | Amir Hossein Kargaran, Franois Yvon, Hinrich Schtze |
| 2024 | Constructing Indonesian-English Travelogue Dataset. | Eunike Andriani Kardinata, Hiroki Ouchi, Taro Watanabe |
| 2024 | Evaluating Automatic Subtitling: Correlating Post-editing Effort and Automatic Metrics. | Alina Karakanta, Mauro Cettolo, Matteo Negri, Luisa Bentivogli |
| 2024 | Towards Comprehensive Language Analysis for Clinically Enriched Spontaneous Dialogue. | Baris Karacan, Ankit Aich, Avery Quynh, Amy E. Pinkham, Philip D. Harvey, Colin A. Depp, Natalie Parde |
| 2024 | MAGIC: Multi-Argument Generation with Self-Refinement for Domain Generalization in Automatic Fact-Checking. | Wei-Yu Kao, An-Zi Yen |
| 2024 | TeClass: A Human-Annotated Relevance-based Headline Classification and Generation Dataset for Telugu. | Gopichand Kanumolu, Lokesh Madasu, Nirmal Surange, Manish Shrivastava |
| 2024 | Emancipating Event Extraction from the Constraints of Long-Tailed Distribution Data Utilizing Large Language Models. | Zhigang Kan, Liwen Peng, Linbo Qiao, Dongsheng Li |
| 2024 | Massively Multilingual Token-Based Typology Using the Parallel Bible Corpus. | Amanda Kann |
| 2024 | Improving Low-Resource Keyphrase Generation through Unsupervised Title Phrase Generation. | Byungha Kang, Youhyun Shin |
| 2024 | Denoising Table-Text Retrieval for Open-Domain Question Answering. | Deokhyung Kang, Baikjin Jung, Yunsu Kim, Gary Geunbae Lee |
| 2024 | Controlled Generation with Prompt Insertion for Natural Language Explanations in Grammatical Error Correction. | Masahiro Kaneko, Naoaki Okazaki |
| 2024 | Triple-R: Automatic Reasoning for Fact Verification Using Language Models. | Mohammadamin Kanaani |
| 2024 | The Role of Syntactic Span Preferences in Post-Hoc Explanation Disagreement. | Jonathan Kamp, Lisa Beinborn, Antske Fokkens |
| 2024 | Using Persuasive Writing Strategies to Explain and Detect Health Misinformation. | Danial Kamali, Joseph D. Romain, Huiyi Liu, Wei Peng, Jingbo Meng, Parisa Kordjamshidi |
| 2024 | EMAD: A Bridge Tagset for Unifying Arabic POS Annotations. | Omar Kallas, Go Inoue, Nizar Habash |
| 2024 | Linguistic Nudges and Verbal Interaction with Robots, Smart-Speakers, and Humans. | Natalia Kalashnikova, Ioana Vasilescu, Laurence Devillers |
| 2024 | Utilizing Longer Context than Speech Bubbles in Automated Manga Translation. | Hiroto Kaino, Soichiro Sugihara, Tomoyuki Kajiwara, Takashi Ninomiya, Joshua B. Tanner, Shonosuke Ishiwatari |
| 2024 | BenLLM-Eval: A Comprehensive Evaluation into the Potentials and Pitfalls of Large Language Models on Bengali NLP. | Mohsinul Kabir, Mohammed Saidul Islam, Md. Tahmid Rahman Laskar, Mir Tafseer Nayeem, M. Saiful Bari, Enamul Hoque |
| 2024 | The Syntactic Acceptability Dataset (Preview): A Resource for Machine Learning and Linguistic Analysis of English. | Tom S. Juzek |
| 2024 | How Large Language Models Encode Context Knowledge? A Layer-Wise Probing Study. | Tianjie Ju, Weiwei Sun, Wei Du, Xinwei Yuan, Zhaochun Ren, Gongshen Liu |
| 2024 | CASIMIR: A Corpus of Scientific Articles Enhanced with Multiple Author-Integrated Revisions. | Lane Isabelle Jourdan, Florian Boudin, Nicolas Hernandez, Richard Dufour |
| 2024 | Aligning the Norwegian UD Treebank with Entity and Coreference Information. | Tollef Emil Jrgensen, Andre Ksen |
| 2024 | An Untold Story of Preprocessing Task Evaluation: An Alignment-based Joint Evaluation Approach. | Eunkyul Leah Jo, Angela Yoonseo Park, Grace Tianjiao Zhang, Izia Xiaoxiao Wang, Junrui Wang, MingJia Mao, Jungyeul Park |