| 2026 | To Overfit or Not to Overfit? An Evaluation of HTR Workflow on 17Th-18Th Century French Corpus. | Marine Tiger |
| 2026 | OpenSubtitles2024: A Massively Parallel Dataset of Movie Subtitles for MT Development and Evaluation. | Jrg Tiedemann, Hengyu Luo |
| 2026 | Simulating Student Interactions for Virtual Pretesting with In-Context Learning. | Arthur Thuy, Luca Benedetto, Ekaterina Loginova, Dries F. Benoit |
| 2026 | A Study on Building Efficient Zero-Shot Relation Extraction Models. | Hugo Thomas, Caio Corro, Guillaume Gravier, Pascale Sbillot |
| 2026 | Beyond Literal Meaning: How LLMs Interpret Yemeni Proverbs. | Nasser Thmer, Ali Al-Laith, Muhammad Shoaib |
| 2026 | AmDi - Ambiguous Words Diachronic Dataset. | Felix Thielen, Kai Kugler |
| 2026 | Diagnosing Translated Benchmarks: An Automated Quality Assurance Study of the EU20 Benchmark Suite. | Klaudia Thellmann, Bernhard Stadler, Michael Frber |
| 2026 | How Far Can Bias Go? Tracing Bias from Pre-Training Data to Alignment. | Marion Thaler, Abdullatif Kksal, Alina Leidinger, Anna Korhonen, Hinrich Schtze |
| 2026 | MUSIA: Multilingual Story Illustration Corpus for Cross-Cultural Alignment and Generation. | Krishna Tewari, Supriya Chanda, Nirmit Patil, Sukomal Pal |
| 2026 | Large Language Models Are Good Term Extractors: A Systematic Evaluation. | Ayla Rigouts Terryn |
| 2026 | Evaluating Multimodal Large Language Model Narrative Interpretation through the Lens of Appraisal Theory. | Jayant Teotia, Xiaowei Wang, Xulang Zhang, Rui Mao, Erik Cambria |
| 2026 | LGSE: Lexically Grounded Subword Embedding Initialization for Low-Resource Language Adaptation. | Hailay Kidu Teklehaymanot, Dren Fazlija, Wolfgang Nejdl |
| 2026 | FalAR: A Large-scale Speaker-Annotated European Portuguese Speech Corpus of Parliamentary Sessions. | Francisco Teixeira, Carlos Carvalho, Mariana Julio, Catarina Botelho, Rubn Solera-Urea, Srgio Paulo, Thomas Rolland, Ben Peters, Isabel Trancoso, Alberto Abad |
| 2026 | Conversational Assistants to Support Patients with Heart Failure: Comparing a Neurosymbolic Architecture with GPT. | Anuja Tayal, Devika Salunke, Barbara Di Eugenio, Paula G. Allen-Meares, Eullia Puig Abril, Olga Garcia-Bedoya, Carolyn Dickens, Andrew D. Boyd |
| 2026 | PHEB: An European Portuguese High School-Level LLM Benchmark. | Diogo C. Tavares, Rafael Ferreira, Afonso Simplcio, Gonalo Vinagre, Ana Carolina Condez, Ins Calvo, Ins Vieira, David Semedo, Joo Magalhes |
| 2026 | RuznamceNER: A Named Entity Recognition Dataset for Ottoman Turkish. | Esma Fatima Bilgin Tasdemir, Dilara Zeynep Grer, Saziye Betl zates |
| 2026 | A Shoal of Voices: Parallel Read Speech from Professional Swedish Narrators. | Christina Tnnander, Jim O'Regan, Jens Edlund |
| 2026 | Beyond Catalogue Counts: The Dataset Visibility Asymmetry in Low-Resource Multilingual NLP. | Zhiyin Tan, Changxu Duan |
| 2026 | Emotion Transcription in Conversation: A Benchmark for Capturing Subtle and Complex Emotional States through Natural Language. | Yoshiki Tanaka, Ryuichi Uehara, Koji Inoue, Michimasa Inaba |
| 2026 | VUPMC: A New Political Metaphor Corpus in Mandarin Chinese. | Xiaojuan Tan |
| 2026 | Bangla Key2Text: Text Generation from Keywords for a Low Resource Language. | Tonmoy Talukder, G. M. Shahariar |
| 2026 | Seeing the Other Side: Diagnostic Tasks for Viewpoint Reasoning in Vision-Language Models. | Makoto Takenaka, Hitomi Yanaka |
| 2026 | Evaluating the Effect of Question Wording Variations on Answer Consistency in Large Language Models. | Junya Takayama, Masaya Ohagi, Tomoya Mizumoto, Katsumasa Yoshikawa |
| 2026 | Construction of Japanese Prefectural Assembly Minutes Datasets across Three Electoral Terms: Comparative Analysis of 2011, 2015, and 2019 Four-Year Periods. | Keiichi Takamaru, Hokuto Ototake, Yuzu Uchida, Yasutomo Kimura |
| 2026 | eSciBench: An Extensible Scientific PDF Extraction Benchmark. | Noah Tremblay Taillon, Phillippe Langlais |