| 2026 | CHiRPE: A Step Towards Real-World Clinical NLP with Clinician-Oriented Model Explanations. | Stephanie Fong, Zimu Wang, Guilherme C. Oliveira, Xiangyu Zhao, Yiwen Jiang, Jiahe Liu, Beau-Luke Colton, Scott W. Woods, Martha Shenton, Barnaby Nelson, Zongyuan Ge, Dominic Dwyer |
| 2026 | Pretraining Language Models for Diachronic Linguistic Change Discovery. | Elisabeth Fittschen, Sabrina Li, Tom Lippincott, Leshem Choshen, Craig Messner |
| 2026 | Thesis Proposal: Measuring Prejudice at Scale. | Zoran Fijavz, Senja Pollak, Veronika Bajt |
| 2026 | Evaluating Sparse Autoencoders for Monosemantic Representation. | Moghis Fereidouni, Muhammad Umair Haider, Peizhong Ju, A. B. Siddique |
| 2026 | Tracking the Limits of Knowledge Propagation: How LLMs Fail at Multi-Step Reasoning with Conflicting Knowledge. | Yiyang Feng, Zeming Chen, Haotian Wu, Jiawei Zhou, Antoine Bosselut |
| 2026 | LitBench: A Benchmark and Dataset for Reliable Evaluation of Creative Writing. | Daniel Fein, Sebastian Russo, Violet Xiang, Kabir Jolly, Rafael Rafailov, Nick Haber |
| 2026 | FanarGuard: A Culturally-Aware Moderation Filter for Arabic Language Models. | Masoomali Fatehkia, Enes Altinisik, Husrev Taha Sencar |
| 2026 | Multilingual Amnesia: On the Transferability of Unlearning in Multilingual LLMs. | Alireza Dehghanpour Farashah, Aditi Khandelwal, Marylou Fauchard, Zhuan Shi, Negar Rostamzadeh, Golnoosh Farnadi |
| 2026 | Linguistic Cues for LLM-based Implicit Discourse Relation Classification. | Yi Fan, Michael Strube, Wei Liu |
| 2026 | KETCHUP: K-Step Return Estimation for Sequential Knowledge Distillation. | Jiabin Fan, Guoqing Luo, Michael Bowling, Lili Mou |
| 2026 | How Much Pretraining Does Structured Data Need? | Daniel Fadlon, Kfir Bar |
| 2026 | Bringing Emerging Architectures to Sequence Labeling in NLP. | Ana Ezquerro, Carlos Gmez-Rodrguez, David Vilares |
| 2026 | AfriMMT-EA: Multi-domain Machine Translation for Low-Resource East African Languages. | Naome A. Etori, Kelechi Ezema, Nathaniel Romney Robinson, Davis David, Alfred Malengo Kondoro, Elisha Ondieki Makori, Michael S. Mollel, Maria L. Gini |
| 2026 | DELTA: A Toolkit for Measuring Linguistic Diversity in Dependency-Parsed Corpora. | Louis Estve, Kaja Dobrovoljc |
| 2026 | SmartMatch: Real-Time Semantic Retrieval for Translation Memory Systems. | Ernesto Luis Estevanell-Valladares, Salima Lamsiyah, Alicia Picazo-Izquierdo, Tharindu Ranasinghe, Ruslan Mitkov, Rafael Muoz |
| 2026 | Trove: A Flexible Toolkit for Dense Retrieval. | Reza Esfandiarpoor, Max Zuo, Stephen H. Bach |
| 2026 | Safe-Unsafe Concept Separation Emerges from a Single Direction in Language Models Activation Space. | Andrea Ermellino, Lorenzo Malandri, Fabio Mercorio, Antonio Serino |
| 2026 | Cetvel: A Unified Benchmark for Evaluating Language Understanding, Generation and Cultural Capacity of LLMs for Turkish. | Yakup Abrek Er, Ilker Kesen, Gzde Gl Sahin, Aykut Erdem |
| 2026 | GRITHopper: Decomposition-Free Multi-Hop Dense Retrieval. | Justus-Jonas Erker, Nils Reimers, Iryna Gurevych |
| 2026 | FiMMIA: scaling semantic perturbation-based membership inference across modalities. | Anton A. Emelyanov, Sergei Kudriashov, Alena Fenogenova |
| 2026 | LingGen: Scalable Multi-Attribute Linguistic Control via Power-Law Masking. | Mohamed Elgaar, Hadi Amiri |
| 2026 | Live API-Bench: 2500+ Live APIs for Testing Multi-Step Tool Calling. | Benjamin Elder, Anupama Murthi, Jungkoo Kang, Ankita Naik, Kinjal Basu, Kiran Kate, Danish Contractor |
| 2026 | ARC: Argument Representation and Coverage Analysis for Zero-Shot Long Document Summarization with Instruction Following LLMs. | Mohamed Elaraby, Diane J. Litman |
| 2026 | Simplifying Outcomes of Language Model Component Analyses with ELIA. | Aaron Louis Eidt, Nils Feldhus |
| 2026 | A Scalable Framework for Automated NER Annotation Correction in Low-Resource Languages. | Toqeer Ehsan, Thamar Solorio |