| 2026 | MzansiText and MzansiLM: An Open Corpus and Decoder-Only Language Model for South African Languages. | Anri M. Lombard, Simbarashe Mawere, Temi Aina, Ethan Wolff, Sbonelo Gumede, Elan Novick, Francois Meyer, Jan Buys |
| 2026 | Conversational Implicatures through the Lens of LLMs. | Agnese Lombardi, Alessandro Lenci |
| 2026 | Corpus and Baselines for Distinguishing Authentic, AI-Generated, and AI-Enhanced Resumes. | Andrea Loizidou, Anshu Kiran Sharma, Adrian Esquivel, Mark A Finlayson, Mustafa Ocal |
| 2026 | Ithaca Revisited: Benchmarking a Domain-Specific Model for Epigraphy in the Age of LLMs. | Alessandro Locaputo, Andrea Brunello, Nicola Saccomanno, Paraskevi Platanou, Giuseppe Serra |
| 2026 | The Megrelian Language Corpus (MLC): Creation, Annotation, and Initial Steps toward a UD Treebank. | Irina Lobzhanidze, Rusudan Gersamia, Tamar Gogia |
| 2026 | ParlaSpeech 3.0: Richly Annotated Spoken Parliamentary Corpora of Croatian, Czech, Polish, and Serbian. | Nikola Ljubesic, Peter Rupnik, Ivan Porupski, Taja Kuzman Pungersek |
| 2026 | SciCiteVal: A Multi-Domain Dataset for Scientific Citation Verification. | Qinyue Liu, Yongxin Zhou, Cyril Labb |
| 2026 | OasisSimp: An Open-source Asian-English Sentence Simplification Dataset. | Hannah Liu, Murphy Tian, Iqra Ali, Haonan Gao, Qiaoyiwen Wu, Blair Yang, Uthayasanker Thayasivam, Annie En-Shiun Lee, Pakawat Nakwijit, Surangika Ranathunga, Ravi Shekhar |
| 2026 | SiniticMTError: A Machine Translation Dataset with Error Annotations for Sinitic Languages. | Hannah Liu, Junghyun Min, Annie En-Shiun Lee, Ethan Yue Heng Cheung, Shou-Yi Hung, Elsie Chan, Shiyao Qian, Runtong Liang, Kimlan Huynh, Wing Yu Yip, York Hay Ng, Tsz Fung Yau, Ka Ieng Charlotte Lo, You-Wei Wu, Richard Tzong-Han Tsai |
| 2026 | New Trends for Modern Machine Translation with Large Reasoning Models. | Sinuo Liu, Chenyang Lyu, Minghao Wu, Zifu Shang, Longyue Wang, Weihua Luo, Kaifu Zhang |
| 2026 | Evaluating Social Intelligence in LLMs via Japanese Honorifics in Email Generation: A Social Semiotic System Perspective. | Muxuan Liu, Tatsuya Ishigaki, Yusuke Miyao, Hiroya Takamura, Ichiro Kobayashi |
| 2026 | Introducing MELI: The Mandarin-English Language Interview Corpus. | Suyuan Liu, Molly Babel |
| 2026 | Resource-Lean Lexicon Induction for German Dialects. | Robert Litschko, Barbara Plank, Diego Frassinelli |
| 2026 | Do Large Language Models Grasp the Grammar? Evidence from Grammar-Book-Guided Probing in Luxembourgish. | Lujun Li, Yewei Song, Lama Sleem, Yiqun Wang, Yangjie Xu, Cedric Lothritz, Niccol Gentile, Radu State, Tegawend F. Bissyand, Jacques Klein |
| 2026 | Construction of a Japanese RAG Benchmark Using Synthetic Documents on Non-existent Entities and Events. | Shengzhe Li, Masaya Ohagi, Hayato Tsukagoshi, Akihiko Fukuchi, Tomohide Shibata, Daisuke Kawahara |
| 2026 | JMTEB and JMTEB-lite: Japanese Massive Text Embedding Benchmark and Its Lightweight Version. | Shengzhe Li, Masaya Ohagi, Ryokan Ri, Akihiko Fukuchi, Tomohide Shibata, Daisuke Kawahara |
| 2026 | VideoEvent: Leveraging Relevance and LLMs for Video Question Answering. | Chen-Chen Lin, Ming-Han Lee, Kun-Ru Wu, Yu-Chee Tseng |
| 2026 | VG-CoT: Towards Trustworthy Visual Reasoning via Grounded Chain-of-Thought. | Byeonggeuk Lim, Kyeonghyun Kim, Jungmin Yun, Youngbin Kim |
| 2026 | Estonian Native Large Language Model Benchmark. | Helena Grete Lillepalu, Tanel Alume |
| 2026 | Grounded Misunderstandings in Asymmetric Dialogue: A Perspectivist Annotation Scheme for MapTask. | Nan Li, Albert Gatt, Massimo Poesio |
| 2026 | Lexicalized Constituency Parsing for Middle Dutch: Low-resource Training and Cross-Domain Generalization. | Yiming Liang, Fang Zhao |
| 2026 | The Limits of Data Scaling: Sub-token Utilization and Acoustic Saturation in Multilingual ASR. | Siyu Liang, Nicolas Ballier, Gina-Anne Levow, Richard A. Wright |
| 2026 | GUMBridge: A Corpus for Varieties of Bridging Anaphora. | Lauren Levine, Amir Zeldes |
| 2026 | ViWikiFC: Fact-Checking for Vietnamese Wikipedia-Based Textual Knowledge Source. | Hung Tuan Le, Long Truong To, Manh Trong Nguyen, Kiet Van Nguyen |
| 2026 | Assessing the Political Fairness of Multilingual LLMs: A Case Study Based on a 21-Way Multiparallel EuroParl Dataset. | Paul Lerner, Franois Yvon |