| 2024 | Effective Integration of Text Diffusion and Pre-Trained Language Models with Linguistic Easy-First Schedule. | Yimin Ou, Ping Jian |
| 2024 | A Corpus of German Abstract Meaning Representation (DeAMR). | Christoph Otto, Jonas Groschwitz, Alexander Koller, Xiulin Yang, Lucia Donatelli |
| 2024 | Evaluation of Really Good Grammatical Error Correction. | Robert stling, Katarina Gillholm, Murathan Kurfali, Marie Mattson, Mats Wirn |
| 2024 | Text Style Transfer Evaluation Using Large Language Models. | Phil Sidney Ostheimer, Mayank Kumar Nagda, Marius Kloft, Sophie Fellenz |
| 2024 | How Much Do Robots Understand Rudeness? Challenges in Human-Robot Interaction. | Michael Andrew Orme, Yanchao Yu, Zhiyuan Tan |
| 2024 | Schroedinger's Threshold: When the AUC Doesn't Predict Accuracy. | Juri Opitz |
| 2024 | Mitigating Linguistic Artifacts in Emotion Recognition for Conversations from TV Scripts to Daily Conversations. | Donovan Ong, Shuo Sun, Jian Su, Bin Chen |
| 2024 | Developing a Benchmark for Pronunciation Feedback: Creation of a Phonemically Annotated Speech Corpus of isiZulu Language Learner Speech. | Alexandra O'Neil, Nils Hjortnaes, Francis M. Tyers, Zinhle Nkosi, Thulile Ndlovu, Zanele Mlondo, Ngami Phumzile Pewa |
| 2024 | SlovakSum: A Large Scale Slovak Summarization Dataset. | Viktoria Ondrejova, Marek Suppa |
| 2024 | JDocQA: Japanese Document Question Answering Dataset for Generative Language Models. | Eri Onami, Shuhei Kurita, Taiki Miyanishi, Taro Watanabe |
| 2024 | An Empirical Study of Synthetic Data Generation for Implicit Discourse Relation Recognition. | Kazumasa Omura, Fei Cheng, Sadao Kurohashi |
| 2024 | Collecting Linguistic Resources for Assessing Children's Pronunciation of Nordic Languages. | Anne Marte Haug Olstad, Anna Smolander, Sofia Strmbergsson, Sari Ylinen, Minna Lehtonen, Mikko Kurimo, Yaroslav Getman, Tams Grsz, Xinwei Cao, Torbjrn Svendsen, Giampiero Salvi |
| 2024 | CyberAgressionAdo-v2: Leveraging Pragmatic-Level Information to Decipher Online Hate in French Multiparty Chats. | Anas Ollagnier |
| 2024 | Automatic Construction of a Large-Scale Corpus for Geoparsing Using Wikipedia Hyperlinks. | Keyaki Ohno, Hirotaka Kameko, Keisuke Shirai, Taichi Nishimura, Shinsuke Mori |
| 2024 | JMultiWOZ: A Large-Scale Japanese Multi-Domain Task-Oriented Dialogue Dataset. | Atsumoto Ohashi, Ryu Hirai, Shinya Iizuka, Ryuichiro Higashinaka |
| 2024 | rynSpeech: A Multi-purpose Yorb Speech Corpus. | Tollop gnrm, Kola Tubosun, Aremu Anuoluwapo, Iroro Orife, David Ifeoluwa Adelani |
| 2024 | Polish Discourse Corpus (PDC): Corpus Design, ISO-Compliant Annotation, Data Highlights, and Parser Development. | Maciej Ogrodniczuk, Aleksandra Tomaszewska, Daniel Ziembicki, Sebastian Zurowski, Ryszard Tuora, Aleksandra Zwierzchowska |
| 2024 | Controllable Paraphrase Generation for Semantic and Lexical Similarities. | Yuya Ogasa, Tomoyuki Kajiwara, Yuki Arase |
| 2024 | MWE-Finder: A Demonstration. | Jan Odijk, Martin Kroon, Tijmen Baarda, Ben Bonfil, Sheean Spoel |
| 2024 | A Canonical Form for Flexible Multiword Expressions. | Jan Odijk |
| 2024 | Educational Dialogue Systems for Visually Impaired Students: Introducing a Task-Oriented User-Agent Corpus. | Elisa Di Nuovo, Manuela Sanguinetti, Pier Felice Balestrucci, Luca Anselma, Cristian Bernareggi, Alessandro Mazzei |
| 2024 | Hybrid of Spans and Table-Filling for Aspect-Level Sentiment Triplet Extraction. | Minghua Nuo, Chaofan Guo |
| 2024 | DGS-Fabeln-1: A Multi-Angle Parallel Corpus of Fairy Tales between German Sign Language and German Text. | Fabrizio Nunnari, Eleftherios Avramidis, Cristina Espaa-Bonet, Marco Gonzlez, Anna Hennes, Patrick Gebhard |
| 2024 | Text2Story Lusa: A Dataset for Narrative Analysis in European Portuguese News Articles. | Srgio Nunes, Alpio Mrio Jorge, Evelin Amorim, Hugo O. Sousa, Antonio Leal, Purificao Moura Silvano, Ins Cantante, Ricardo Campos |
| 2024 | Linking Named Entities in Diderot's Encyclopdie to Wikidata. | Pierre Nugues |