| 2022 | Towards Evaluation of Cross-document Coreference Resolution Models Using Datasets with Diverse Annotation Schemes. | Anastasia Zhukova, Felix Hamborg, Bela Gipp |
| 2022 | FGraDA: A Dataset and Benchmark for Fine-Grained Domain Adaptation in Machine Translation. | Wenhao Zhu, Shujian Huang, Tong Pu, Pingxuan Huang, Xu Zhang, Jian Yu, Wei Chen, Yanfeng Wang, Jiajun Chen |
| 2022 | MMChat: Multi-Modal Chat Dataset on Social Media. | Yinhe Zheng, Guanyi Chen, Xin Liu, Jian Sun |
| 2022 | PCR4ALL: A Comprehensive Evaluation Benchmark for Pronoun Coreference Resolution in English. | Xinran Zhao, Hongming Zhang, Yangqiu Song |
| 2022 | A Simple Yet Effective Corpus Construction Method for Chinese Sentence Compression. | Yang Zhao, Hiroshi Kanayama, Issei Yoshida, Masayasu Muraoka, Akiko Aizawa |
| 2022 | The ManDi Corpus: A Spoken Corpus of Mandarin Regional Dialects. | Liang Zhao, Eleanor Chodroff |
| 2022 | HRCA+: Advanced Multiple-choice Machine Reading Comprehension Method. | Yuxiang Zhang, Hayato Yamana |
| 2022 | How Does the Experimental Setting Affect the Conclusions of Neural Encoding Models? | Xiaohan Zhang, Shaonan Wang, Chengqing Zong |
| 2022 | STAPI: An Automatic Scraper for Extracting Iterative Title-Text Structure from Web Documents. | Nan Zhang, Shomir Wilson, Prasenjit Mitra |
| 2022 | A Distant Supervision Corpus for Extracting Biomedical Relationships Between Chemicals, Diseases and Genes. | Dongxu Zhang, Sunil Mohan, Michaela Torkar, Andrew McCallum |
| 2022 | DirectQuote: A Dataset for Direct Quotation Extraction and Attribution in News Articles. | Yuanchi Zhang, Yang Liu |
| 2022 | Kompetencer: Fine-grained Skill Classification in Danish Job Postings via Distant Supervision and Transfer Learning. | Mike Zhang, Kristian Nrgaard Jensen, Barbara Plank |
| 2022 | Huqariq: A Multilingual Speech Corpus of Native Languages of Peru forSpeech Recognition. | Rodolfo Zevallos, Luis Camacho, Nelsi Melgarejo |
| 2022 | Building an Endangered Language Resource in the Classroom: Universal Dependencies for Kakataibo. | Roberto Zariquiey, Claudia Alvarado, Ximena Echevarra, Luisa Gomez, Rosa Gonzales, Mariana Illescas, Sabina Oporto, Frederic Blum, Arturo Oncevay, Javier Vera |
| 2022 | Bicleaner AI: Bicleaner Goes Neural. | Jaume Zaragoza-Bernabeu, Gema Ramrez-Snchez, Marta Ban, Sergio Ortiz-Rojas |
| 2022 | Identification of Multiword Expressions in Tweets for Hate Speech Detection. | Nicolas Zampieri, Carlos Ramisch, Irina Illina, Dominique Fohr |
| 2022 | Slovene SuperGLUE Benchmark: Translation and Evaluation. | Ales Zagar, Marko Robnik-Sikonja |
| 2022 | Towards Universal Segmentations: UniSegments 1.0. | Zdenek Zabokrtsk, Niyati Bafna, Jan Bodnr, Luks Kyjnek, Emil Svoboda, Magda Sevckov, Jons Vidra |
| 2022 | UgChDial: A Uyghur Chat-based Dialogue Corpus for Response Space Classification. | Zulipiye Yusupujiang, Jonathan Ginzburg |
| 2022 | Speech Aerodynamics Database, Tools and Visualisation. | Shi Yu, Clara Ponchard, Roland Trouville, Sergio Hassid, Didier Demolin |
| 2022 | Modality Alignment between Deep Representations for Effective Video-and-Language Learning. | Hyeongu Yun, Yongil Kim, Kyomin Jung |
| 2022 | The Universal Anaphora Scorer. | Juntao Yu, Sopan Khosla, Nafise Sadat Moosavi, Silviu Paun, Sameer Pradhan, Massimo Poesio |
| 2022 | Automatic Speech Recognition Datasets in Cantonese: A Survey and New Dataset. | Tiezheng Yu, Rita Frieske, Peng Xu, Samuel Cahyawijaya, Cheuk Tung Shadow Yiu, Holy Lovenia, Wenliang Dai, Elham J. Barezi, Qifeng Chen, Xiaojuan Ma, Bertram E. Shi, Pascale Fung |
| 2022 | An automatic model and Gold Standard for translation alignment of Ancient Greek. | Tariq Yousef, Chiara Palladino, Farnoosh Shamsian, Anise d'Orange Ferreira, Michel Ferreira dos Reis |
| 2022 | Frame Shift Prediction. | Zheng Xin Yong, Patrick D. Watson, Tiago Timponi Torrent, Oliver Czulo, Collin F. Baker |